# Eine neue Filterpolicy ohne Blindflug ausrollen Typ: Checkliste Herkunft: llm-production-ops / guardrail-runtime-ops / ops-policy-canary Version: ops-policy-canary-2026-09-04 Geprüft: 2026-09-04 ACHTUNG: Dieses Dokument ist ein Lernartefakt aus einer Schulungssequenz. Es ist kein produktives Runbook. Vor jeder Anwendung in einer realen Umgebung müssen die Schritte gegen lokale Dokumentation, Runbooks und Freigabestatus geprüft werden. ## Szenario Eine strengere Guardrail-Version soll Missbrauch besser erkennen, könnte aber legitime Supportanfragen blockieren. ## Schritte 1. Policy, Schwellen und Abhängigkeiten als unveränderliche Version festhalten 2. Version gegen kuratierte positive und negative Fälle im Schatten auswerten 3. Kleine repräsentative Population mit klaren Stop-Grenzen exponieren 4. Schutz-, Fehlalarm-, Latenz- und Ausfall-SLIs mit der Kontrolle vergleichen 5. Nur bei bestandenem Gate stufenweise ausweiten, sonst auf die alte Version zurückschalten ## Begründung Warum: Guardrail-Policies sind verhaltenswirksame Produktionsartefakte und benötigen denselben kontrollierten Releasepfad wie andere Konfiguration. Folgen: **+** Fehlalarme und Schutzregressionen treffen zunächst nur eine begrenzte Population. **−** Parallele Auswertung und gelabelte Testfälle kosten Laufzeit und Pflege. ## Quellen 1. OWASP LLM01 Prompt Injection — https://genai.owasp.org/llmrisk/llm01-prompt-injection/ 2. OWASP LLM10 Unbounded Consumption — https://genai.owasp.org/llmrisk/llm102025-unbounded-consumption/ 3. NIST AI RMF Core — https://airc.nist.gov/airmf-resources/airmf/5-sec-core/ 4. Google SRE Book, Addressing Cascading Failures — https://sre.google/sre-book/addressing-cascading-failures/ 5. Google SRE Workbook, Managing Load — https://sre.google/workbook/managing-load/