LLM Production Ops

Betrieb der Retrieval-Pipeline

Der jüngste Datensatz ist aktuell und das Frische-Dashboard grün, trotzdem fehlt ein kompletter Shard. Später bleibt ein gelöschtes Dokument im Index. Wer nur erfolgreiche Upserts misst, übersieht die gefährlichsten stillen Pipelinefehler.

~25 Min · 10 Abschnitte Einführung · 8 Übungen (davon 3 Missionen)

Modul starten →

Fortschritt wird gespeichert — du kannst das Modul später jederzeit fortsetzen.

Nur den Lehrtext lesen →

Das kannst du danach

  • Danach kannst du Frische, Vollständigkeit und Korrektheit als getrennte Pipeline-SLIs formulieren.
  • Du gestaltest Replay, Tombstones und Fortschrittsmarker so, dass Arbeit sicher wiederholt werden kann.
  • Du weißt, wie Neuaufbau und Embedding-Migration über versionierte Indizes, Vergleich und reversiblen Cutover laufen.

Übungen

  • 1. EntscheidungWelchen Alarm baust du, damit dieser Fall künftig auffällt?
  • 2. EntscheidungWelche zusätzliche Zusage hätte den Fehler sichtbar gemacht?
  • 3. EntscheidungWas ist die richtige Reihenfolge der Maßnahmen?
  • 4. MissionReplay ohne stilles Überspringen
  • 5. EntscheidungWie führst du den Neuaufbau durch?
  • 6. DiagnoseEine Löschung bis in den Index verfolgen
  • 7. ReihenfolgeEinen neuen Index kontrolliert aktivieren
  • 8. EntscheidungWie bewertest du diesen Migrationsplan?

Arbeitsartefakte

Quellen & Aktualität4 Primärquellen · zuletzt geprüft:
  1. 01Google SRE Workbook, Data Processing Pipelines
  2. 02Google SRE Book, Data Processing Pipelines
  3. 03Google SRE Workbook, Configuration Design
  4. 04GDPR Article 17

Verfasst von Julian Zentgraf