Cloud Infrastructure & Platform Engineering

Plattform-Observability & Audit

Du trennst Betriebsmetriken, Diagnoseereignisse und manipulationsgeschützte Auditdaten, leitest Alarme aus Nutzerwirkung und SLOs ab und verknüpfst jede Plattformänderung mit Identität, Freigabe und beobachteter Wirkung.

Fortgeschritten · ~25 Min · 12 Abschnitte Einführung · 8 Übungen (davon 0 Missionen)

Modul starten →

Fortschritt wird gespeichert — du kannst das Modul später jederzeit fortsetzen.

Nur den Lehrtext lesen →

Das kannst du danach

  • Plattformsignale aus Nutzerwirkung und Abhängigkeiten ableiten
  • Auditdaten unabhängig, vollständig und zugriffsgeschützt halten
  • Änderung, Wirkung und Verantwortlichkeit über gemeinsame IDs korrelieren

Übungen

  • 1. EntscheidungWas ist der erste belastbare Schritt?
  • 2. EntscheidungWelcher Vertrag reduziert das Betriebsrisiko am wirksamsten?
  • 3. EntscheidungWelche Kennzahlen nimmst du auf?
  • 4. EntscheidungWann gilt der Übergang als abgeschlossen?
  • 5. EntscheidungWie wird die Diagnose geführt?
  • 6. EntscheidungWie stellst du den Audit-Trail neu auf?
  • 7. EntscheidungWie führst du den Nachweis — und was änderst du strukturell?
  • 8. EntscheidungWie wird die Entscheidung verteidigbar getroffen?
Quellen & Aktualität9 Primärquellen · zuletzt geprüft:
  1. 01Google SRE Book: Monitoring Distributed Systems
  2. 02Google SRE Workbook: Alerting on SLOs
  3. 03AWS Well-Architected Framework, Operational Excellence Pillar
  4. 04NIST SP 800-53 Rev. 5 — AU-9 Protection of Audit Information
  5. 05Microsoft Azure Well-Architected Framework: Operational Excellence — Observability
  6. 06Google SRE Workbook: Implementing SLOs
  7. 07AWS Well-Architected Framework, Security Pillar — Detection
  8. 08Microsoft Azure Cloud Adoption Framework: Management and monitoring design area
  9. 09Microsoft Azure Cloud Adoption Framework: Governance

Verfasst von Julian Zentgraf