Monitoring, Troubleshooting & Incident Operations

Major Incidents

Große Ausfälle mit Eskalation, Änderungskontrolle und Wiederherstellung führen.

Lehrtext · 2 Abschnitte · zuletzt geprüft: 2026-07-30

Die Betriebsfrage

Bei großer Nutzerwirkung muss das Team Tempo gewinnen, ohne Evidenz, Kommunikation oder Recovery zu verlieren.

LernzielDu kannst Change, Mitigation und endgültige Ursachenanalyse im Major Incident entkoppeln.

Steuerung

Impact und Eskalation bestätigenSichere Mitigation priorisierenJeden Change mit Hypothese loggenRecovery gegen Nutzer-SLI verifizieren
Mitigation ist nicht Root Cause

Jetzt anwenden

Diesen Stoff gibt es als Modul mit bewerteten Entscheidungs-Checks — dieselbe Einführung, danach die Übungen.

Zum Modul →
Quellen & Aktualität3 Primärquellen · zuletzt geprüft:
  1. 01cisa.gov/resources-tools/resources/federal-gov…y-response-playbooks
  2. 02sre.google/workbook/incident-response
  3. 03sre.google/sre-book/managing-incidents