Cloud Infrastructure & Platform Engineering

Verfügbarkeit & Fehlerdomänen

Du zerlegst Verfügbarkeitsziele in konkrete Fehlerdomänen, Abhängigkeiten, Redundanz- und Wiederherstellungsmaßnahmen und prüfst, ob Kapazität, Datenpfad und Anwendung bei Zonen- oder Regionsverlust tatsächlich funktionieren.

Fortgeschritten · ~25 Min · 12 Abschnitte Einführung · 8 Übungen (davon 0 Missionen)

Modul starten →

Fortschritt wird gespeichert — du kannst das Modul später jederzeit fortsetzen.

Nur den Lehrtext lesen →

Das kannst du danach

  • Fehlerdomänen und korrelierte Abhängigkeiten im Dienstpfad erkennen
  • Redundanz und Wiederherstellung aus SLO und Risiko ableiten
  • Failoverkapazität und Datenkonsistenz durch Übungen belegen

Übungen

  • 1. EntscheidungWas ist der erste belastbare Schritt?
  • 2. EntscheidungWelcher Vertrag reduziert das Betriebsrisiko am wirksamsten?
  • 3. EntscheidungWie stellst du den Dienst auf?
  • 4. EntscheidungWann gilt der Übergang als abgeschlossen?
  • 5. EntscheidungWie wird die Diagnose geführt?
  • 6. EntscheidungWas empfiehlst du?
  • 7. EntscheidungWie wird die Entscheidung verteidigbar getroffen?
  • 8. EntscheidungWie antwortest du auf die Forderung?
Quellen & Aktualität7 Primärquellen · zuletzt geprüft:
  1. 01AWS Well-Architected Framework, Reliability Pillar
  2. 02AWS Well-Architected Framework, Reliability Pillar — Availability definition and calculation
  3. 03Google SRE Book: Embracing Risk
  4. 04Microsoft Azure Well-Architected Framework: Reliability — Redundancy
  5. 05Google SRE Book: Addressing Cascading Failures
  6. 06Google Cloud Architecture Framework: Reliability
  7. 07Microsoft Azure Well-Architected Framework: Reliability

Verfasst von Julian Zentgraf