Was die Konkurrenz (Grok) sagt:
Claude Fable 5.1 ist gestern (1. September 2026) von Anthropic rausgekommen. Es ist das Update zu Claude Fable 5 (Mythos-Klasse), gedacht für schwere Coding-, Recherche- und Agent-Aufgaben über lange Strecken.
Was neu bzw. besser ist
- Deutlich stärker bei langen, mehrstufigen Agent-Jobs: Coding über ganze Codebases, Migrationen, Recherche, Tabellen, Folien, wissenschaftliche Arbeit. Es soll weniger Abkürzungen nehmen und eher die Ursache eines Bugs finden als nur das Symptom.
- Benchmarks (Auswahl): Terminal-Bench-Science 0.1 von 24,7 % auf 52,6 %; Terminal-Bench 4.0 (agentic coding) von 42,0 % auf 55,8 % (Mythos 5.1 sogar 60,9 %); AutomationBench von 17,1 % auf 31,4 %; leichte Pluspunkte auch bei HLE, CursorBench, OSWorld und GDPval. Bei niedrigem/mittlerem Effort oft ähnlich gut wie Fable 5, aber günstiger.
- Preis: Input/Output bleibt 10 / 50 USD pro Million Tokens. Cache-Reads fallen von 1,00 auf 0,25 USD (−75 %). Anthropic rechnet mit ca. 25 % weniger Kosten bei typischer Nutzung und bis zu ca. 45 % bei stark agentischen Workflows.
- Safeguards: weniger False Positives (u. a. ca. 60 % weniger bei Cybersecurity). Fable 5.1 darf Schwachstellen finden, aber keine Exploits bauen. Für Enterprise kommt EFS (Daten liegen in der eigenen Cloud, faktisch Zero Retention); bis dahin Zero Retention für berechtigte Kunden. Mythos 5.1 (gleiche Leistung, andere Filter) bleibt hinter Trusted-Access / Project Glasswing.
- Specs unverändert zur Linie: 1 Mio. Tokens Kontext, 128k max. Output, Adaptive Thinking immer an, Knowledge-Cutoff Juni 2026. Modell-ID:
claude-fable-5-1. Verfügbar über Claude.ai, Claude Code, API, AWS, Google Cloud, Azure/Foundry.
API-Änderungen (wichtig beim Umstieg)
- Forced Tool Use (
tool_choice: any/ festes Tool) geht nicht mehr. - Thinking-Blöcke von 5.1 kann kein älteres Modell lesen; umgekehrt schon.
- Frühere Turns nachträglich ändern invalidiert Thinking-Blöcke.
- Neu (beta): Effort mitten im Gespräch ändern, System-Messages nur für einen Turn, Fortschritts-Updates zwischen Tool-Calls anzeigen, Content-Provenance (Wasserzeichen / C2PA).
Kurz: Kein komplett neues Modell, sondern Fable 5 mit besserem Langstrecken-Agentenverhalten, deutlich günstigerem Caching und etwas weniger nervigen Sicherheits-Fehlalarmen. Für Alltagsarbeit empfiehlt Anthropic oft weiter Opus 5; Fable 5.1 lohnt sich, wenn Opus bei hohem Effort nicht reicht.
The world’s most advanced models for coding and knowledge work, says Anthropic. Read the full announcement here.