Reliabilität & Betrieb: einen Agenten produktionsreif machen
Einführung · 7 Abschnitte · ~9 Min Lesezeit · Stand
Reliabilität ist Betrieb, nicht Prompt
Ein Agent ist ein nichtdeterministisches, verteiltes System mit Nebenwirkungen — kein Prompt. Produktionsreife entsteht nicht durch bessere Formulierung, sondern durch die Ops-Grundlagen: Verifikation, Idempotenz, Budgets, Observability und Guardrails — von der ersten Zeile an.
Verifizieren vor Vertrauen
Die Aktionen und Ausgaben eines Agenten — besonders nebenwirkende — gehören vor dem Wirksamwerden geprüft, nicht vertraut, weil sie „meistens richtig“ sind. Setz einen Verifikations-Schritt (Dry-Run, Test, unabhängige Prüfung) zwischen „Agent entscheidet“ und „Änderung wird angewendet“.
Retries & Idempotenz
Agenten und ihre Loops wiederholen Schritte (Timeout, Retry). Damit muss jede nebenwirkende Aktion idempotent oder retry-safe sein — sonst dupliziert ein Retry die Wirkung (der doppelt belastete Kunde). Der Fix sitzt im Aktions-/Tool-Design, nicht in der „Vorsicht“ des Modells.
Human-in-the-Loop — risikobasiert
Menschliche Freigabe ist eine knappe, wertvolle Kontrolle. Platziere sie an den wenigen hochriskanten/irreversiblen Entscheidungspunkten — nicht bei jeder Aktion. Flächendeckende Freigaben zerstören den Durchsatz und führen zu Rubber-Stamping: der Mensch winkt durch und prüft nicht mehr.
Budgets & Circuit Breaker
Ein Agenten-Endpoint ist eine kostenverursachende Ressource. Ohne Grenzen kann eine einzelne Aufgabe (ein Bug, ein Angreifer) die Kosten ins Unendliche treiben. Setz erzwungene Pro-Aufgabe-Budgets (max. Schritte/Tool-Aufrufe/Tokens) plus Circuit-Breaker, pro Client.
Beobachtbarkeit: die Trajektorie
Weil Fehlschläge nichtdeterministisch sind, kannst du sie nicht aus der Endausgabe debuggen. Trace die ganze Trajektorie — jeden Schritt, jede Tool-Eingabe/-Ausgabe, jede Entscheidung. Der Ablauf-Trace ist das einzige Mittel, einen Fehlschlag zu diagnostizieren und zu reproduzieren.
Failure-Modes, Eval & Guardrails — gleich im Check
Drei Bausteine schließen den Betrieb ab: ehrliches Scheitern (kann der Agent nicht abschließen, liefert er einen definierten Eskalations-Ausgang, keine erfundene Erledigung); Agenten-Evaluation (Erfolgsrate UND Trajektorie über viele Läufe, nicht ein Einzellauf); und Laufzeit-Guardrails (erzwungene Policy auf Aktionen, unabhängig vom Prompt — Defense in Depth).