# Fünf Schritte bis zum Vollbetrieb Typ: Checkliste Herkunft: agentic-ai / agent-eval-rollout / agent-rollout-order Version: agent-rollout-order-2026-09-04 Geprüft: 2026-09-04 ACHTUNG: Dieses Dokument ist ein Lernartefakt aus einer Schulungssequenz. Es ist kein produktives Runbook. Vor jeder Anwendung in einer realen Umgebung müssen die Schritte gegen lokale Dokumentation, Runbooks und Freigabestatus geprüft werden. ## Szenario Eine neue Fassung eines schreibenden Agenten soll ausgerollt werden. Fünf Schritte sind nötig, und jeder braucht das Ergebnis des vorherigen. In falscher Reihenfolge fehlt entweder der Bezugswert oder das Abbruchkriterium. ## Schritte 1. Die aktuelle Fassung über den Testsatz laufen lassen und den Bezugswert festhalten 2. Die neue Fassung über denselben Satz laufen lassen und gegen den Bezugswert vergleichen 3. Im Schattenbetrieb mitlaufen lassen, ohne die Aktionen auszuführen 4. Einen kleinen Verkehrsanteil echt auf die neue Fassung geben, mit vorab gesetztem Abbruchkriterium 5. Auf Vollbetrieb umstellen und den Testsatz um die Fälle des Canary erweitern ## Begründung Warum: Jeder Schritt liefert die Voraussetzung des nächsten: ohne Bezugswert kein Vergleich, ohne Vergleich kein begründeter Schattenlauf, ohne Schattenlauf kein Canary mit vertretbarem Risiko. Und das Abbruchkriterium des Canary stammt aus den Zahlen der ersten zwei Schritte. Folgen: **+** Jede Stufe fängt eine andere Klasse von Fehlern, und der Verkehr mit echter Wirkung kommt erst, wenn die billigeren Prüfungen bestanden sind. **−** Die Kette kostet Zeit und rechnet sich nur bei Änderungen mit Wirkungsrisiko. Für eine Formulierungsänderung ohne Aktionsbezug ist sie überdimensioniert. ## Quellen 1. Anthropic Engineering — Building Effective Agents, https://www.anthropic.com/engineering/building-effective-agents 2. Anthropic Engineering — How we built our multi-agent research system, https://www.anthropic.com/engineering/multi-agent-research-system