Anthropic hat die Biologie-Safety-Routing-Schicht von Claude Fable 5 neu ausgerichtet. Der Hersteller meldet rund 85 Prozent weniger Biologie-Fallbacks in Tests. Die Schutzschicht bleibt bestehen; sie soll aber harmlose Gesundheits-, Lern- und klinische Anfragen deutlich seltener auf das weniger fähige Opus 5 umleiten.
Was sich konkret ändert
Erkennt der Classifier eine abgesicherte Biologie-Aufgabe, wird die Anfrage nicht bei Fable 5 verarbeitet, sondern an Opus 5 geroutet. Anthropic bezeichnet dies als Fallback. Der ursprüngliche Classifier war bewusst breit angelegt; die Überarbeitung soll seine Fehlalarme für gutartige Anfragen reduzieren.
- In Anthropic-Tests gingen Biologie-Fallbacks über die Produktflächen hinweg um etwa 85 Prozent zurück.
- Für alle Fallbacks erwartet Anthropic Rückgänge von rund 67 Prozent auf Claude.ai, 55 Prozent in Cowork, 17 Prozent in Claude Code und 7 Prozent auf der Claude Platform.
- Dual-Use-Biologie, professionelle Forschungsanfragen mit Risiko und Drug-Discovery-Themen bleiben ausgenommen und werden weiterhin auf Opus 5 geroutet.
Kein Modell-Release, sondern eine präzisere Kontrollschicht
Anthropic hat nach eigener Darstellung die Constitution des Classifiers – also die Regeln für erlaubte und abgesicherte Inhalte – differenzierter formuliert, darauf neue Trainingsdaten aufgebaut und den Classifier neu trainiert. Die Veränderung liegt damit nicht im Generationsmodell, sondern in der Infrastruktur, die entscheidet, welches Modell eine Anfrage tatsächlich beantwortet.
Das ist mehr als ein Komfort-Update. Ein breit schaltender Classifier kann die wahrgenommene Fähigkeit eines Frontier-Modells in einem ganzen Themenbereich reduzieren. Umgekehrt muss ein engerer Classifier weiterhin gegen Umgehungsversuche robust bleiben. Anthropic schreibt, den neuen Classifier sowohl auf die Erfassung abgesicherter Biologie-Inhalte als auch auf Jailbreak-Versuche geprüft zu haben.
Die betriebliche Konsequenz: Routing gehört in die Qualitätsmessung
Für Teams, die Modellqualität über Anbieter hinweg vergleichen, ist die relevante Einheit nicht allein der API-Modellname. Safety-Routing kann Requests kontextabhängig auf einen anderen Modellpfad verschieben. Evals, Prompt-Tests und Qualitäts-KPIs sollten solche Downgrades deshalb sichtbar machen – sonst sehen identische API-Aufrufe je nach Risikoeinstufung sehr unterschiedliche Fähigkeiten.
Die operative Frage lautet nicht nur: Welches Modell? Sondern auch: Wann wird es stillschweigend ersetzt?
Primärquelle: Anthropic, Improving Fable-5 biology safeguards, veröffentlicht am 7. August 2026.

Leave a Reply