Release bestätigt: Fable 5.1 erschien am 1. September 2026
Anthropic veröffentlichte Claude Fable 5.1 und Claude Mythos 5.1 am 1. September 2026. Die offizielle Modellseite markiert Fable 5.1 als Active (latest) und nennt als frühestmögliches Retirement den 1. September 2027. [1][2]
Das Modell ist als `claude-fable-5-1` in der Claude API verfügbar sowie über Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry. AWS und Google bestätigten die Verfügbarkeit am selben Tag. [2][8][10]
- Claude API: `claude-fable-5-1`
- Bedrock: `anthropic.claude-fable-5-1`
- Status: Active (latest)
- Release: 1. September 2026
Fable 5.1 und Mythos 5.1: dasselbe Modell, andere Safeguards
Anthropic beschreibt Fable 5.1 und Mythos 5.1 als dasselbe underlying model. Fable 5.1 ist allgemein verfügbar, Mythos 5.1 nur für genehmigte Organisationen in Trusted-Access-Programmen wie Project Glasswing. [1][3][9]
Das ist für Benchmark-Interpretation wichtig: Auf Terminal-Bench 4.0 meldet Anthropic 60,9% für Mythos 5.1 und 55,8% für Fable 5.1 und führt den Abstand auf Safeguard-Eingriffe zurück. [1]
Technische Spezifikation
| Parameter | Fable 5.1 |
|---|---|
| Kontext | 1M |
| Max Output | 128K |
| Thinking | Adaptive, immer an |
| Default API Effort | high |
| Knowledge Cutoff | Juni 2026 |
Fable 5.1 bietet 1M Token Kontext als Default und Maximum, maximal 128K Output-Tokens, Text- und Bildeingabe sowie Textausgabe. Reliable Knowledge Cutoff und Training Cutoff sind Juni 2026. [2][3]
Adaptive Thinking ist immer aktiv. Die API-Dokumentation nennt `high` als Default Effort; Claude Code startet ebenfalls mit High, Claude.ai und Cowork laut Launch-Seite mit Medium. [1][2][3]
Preis: Basis unverändert, Cache Reads 75% günstiger
| Modell | Input / MTok | Cache Read / MTok | Output / MTok |
|---|---|---|---|
| Fable 5.1 | $10 | $0.25 | $50 |
| Fable 5 | $10 | $1.00 | $50 |
| Opus 5 | $5 | $0.50 | $25 |
| Sonnet 5 | $2 | $0.20 | $10 |
Die Basispreise bleiben $10/MTok Input und $50/MTok Output. Ein 5-Minuten-Cache-Write kostet $12.50/MTok, ein 1-Stunden-Write $20/MTok. Cache Reads kosten nur noch $0.25/MTok statt $1.00 bei Fable 5. [3][4]
Batch API reduziert Basis-Input und -Output um 50% auf $5/$25 pro MTok. [4]
Was bedeuten die 25–45% Kosteneinsparung wirklich?
Anthropic schätzt rund 25% niedrigere Gesamtkosten für typische tokenbasierte Workloads und bis zu etwa 45% für stark agentische, cache-intensive Workflows. [1]
Das ist keine generelle Listenpreisreduktion. Die Schätzung basiert laut Anthropic auf vier Wochen tatsächlicher Nutzung im August 2026 bei Default Effort und hängt stark vom Cache-Anteil ab. [1]
- Input/Output-Basispreise unverändert
- Cache Read 75% günstiger
- Typisch ca. 25% Einsparung laut Anthropic
- Highly agentic bis ca. 45% laut Anthropic
Benchmark-Tabelle: stark, aber vendor-reported
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 partial | 77.9% | 72.9% | 75.4% | — |
| OSWorld 2.0 strict | 41.7% | 36.1% | 39.6% | — |
| HLE no tools | 60.9% | 57.8% | 56.6% | — |
| HLE with tools | 65.0% | 63.8% | 63.6% | — |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
Anthropic vergleicht Fable 5.1 mit Fable 5, Opus 5 und GPT-5.6 Sol. Diese Ergebnisse stammen aus Anthropics Launch-Setup und sind kein unabhängiger Nachweis universeller Überlegenheit. [1]
Safeguards waren aktiv und beeinflussten einige Scores. OSWorld 2.0 nutzt die August-2026-Aufgabenversion und ist nicht direkt mit älteren Veröffentlichungen vergleichbar. [1]
Terminal-Bench-Science 0.1: 52,6%
Anthropic meldet 52,6% für Fable 5.1 gegenüber 24,7% Fable 5, 29,0% Opus 5 und 22,4% GPT-5.6 Sol. In genau diesem Setup ist der Wert mehr als doppelt so hoch wie bei Fable 5. [1]
Der angegebene Standardfehler liegt bei etwa ±3,5–4,5 Punkten pro Modell. Kleine Abstände sollten daher nicht überinterpretiert werden. [1]
Terminal-Bench 4.0 und Fable vs Mythos
Fable 5.1 erreicht 55,8%, Mythos 5.1 60,9%, Fable 5 42,0%, Opus 5 52,3% und GPT-5.6 Sol 37,3%. [1]
Anthropic erklärt den höheren Mythos-Wert mit weniger restriktiven Safeguards. Mythos 5.1 ist daher nicht der Score der allgemein verfügbaren Fable-Konfiguration. [1]
GDPval-AA, HLE und AutomationBench
GDPval-AA v2: Fable 5.1 1853, Fable 5 1723, Opus 5 1824, GPT-5.6 Sol 1711. Humanity’s Last Exam: 60,9% ohne Tools und 65,0% mit Tools für Fable 5.1. [1]
AutomationBench liegt bei 31,4% für Fable 5.1 gegenüber 17,1% Fable 5 und 26,9% Opus 5. Das unterstützt die Agentic-Workload-Positionierung, ersetzt aber keine internen Evals. [1]
CursorBench 3.2.0 und OSWorld 2.0
CursorBench 3.2.0: Fable 5.1 73,4%, Fable 5 70,5%, Opus 5 70,0%, GPT-5.6 Sol 67,2%. Der Abstand ist hier deutlich kleiner als auf Terminal-Bench-Science. [1]
OSWorld 2.0: 77,9% partial und 41,7% strict für Fable 5.1. Anthropic warnt vor direktem Vergleich mit älteren OSWorld-Releases. [1]
Effort als Kosten- und Qualitätsregler
Anthropic sagt, dass der Vorsprung von Fable 5.1 bei höherem Effort am größten ist. Gleichzeitig kann Low oder Medium Fable-5-Niveau oder besser zu geringeren Kosten erreichen. [1][3]
Per-message effort kann in der API betaweise während der Unterhaltung geändert werden, ohne den Prompt Cache zu invalidieren. [3]
Capability Gains: lange Agentenläufe, Research und Artefakte
Die Dokumentation nennt sechs Schwerpunktbereiche: Long-Session Agentic Coding, Dokumente/Spreadsheets/Slides, Research und Search, Vision, Long Context und Computer Use. [3]
Für Enterprise-Evals sind deshalb Task Completion, Tool Calls, Retries, Tokens, Wall-Clock-Zeit und Cost per Successful Task wichtiger als ein einzelner Benchmark. [3][6]
Scientific Research: Fable und Mythos sauber trennen
Viele der anspruchsvollsten Forschungsbeispiele im Launch beziehen sich auf Mythos 5.1, die eingeschränkt verfügbare Variante. Anthropic beschreibt unter anderem Protein-Design und autonome Forschungsschleifen. [1]
Anthropic meldet bei drei Targets Binder mit 10× höherer Affinität als die besten Designs bestimmter Adaptyv-Bio-Wettbewerbe und nahezu 50% Hit Rate über 12 Targets. Das sind Anthropic-reported Mythos-Ergebnisse, nicht automatisch öffentliche Fable-Fähigkeiten. [1]
Safeguards: weniger False Positives, weiterhin Grenzen
Anthropic meldet rund 60% weniger Cybersecurity-False-Positives. Source-Code-Vulnerability-Discovery ist nun zulässig, während Exploit Development, Pentesting und binärbasierte Scans je nach Kategorie weiterhin begrenzt werden. [1][3]
Bei harmlosen Grundlagenfragen zu Biologie und Medizin sollen die Interventionen gegenüber dem Fable-5-Launch um etwa 85% gesunken sein. [1]
Data Retention und Enterprise Frontier Safeguards
Fable 5.1 ist standardmäßig ein Covered Model mit 30 Tagen Retention und ohne reguläres ZDR, sofern Anthropic keinen ausdrücklichen Ausnahmezugang genehmigt. [3]
EFS soll Sicherheitsdaten in kundenseitig kontrollierter Cloud-Infrastruktur halten. Anthropic plant einen stufenweisen Rollout später im Herbst; AWS dokumentiert zusätzlich provider-spezifische Retention-Modi. [1][8]
Content Provenance: Text-Watermark und C2PA
Fable-5.1-Text trägt laut Anthropic auf allen unterstützten Plattformen ein statistisches Watermark, ohne zusätzliche Tokens oder versteckte Zeichen. [3]
Unterstützte Bild- und Videodateien können beim Abruf über die Files API signierte C2PA Content Credentials erhalten. [3]
Breaking Change: Forced Tool Use nicht unterstützt
{
"tool_choice": {"type": "auto"}
}
`tool_choice` mit `any` oder einem erzwungenen Tool liefert HTTP 400. `auto` und `none` bleiben unterstützt. [3][5]
Für validiertes JSON empfiehlt Anthropic Strict Tool Use mit `auto` oder Structured Outputs. [3]
Thinking Blocks verlangen Append-only History
Fable 5.1 kann ältere Thinking Blocks lesen, ältere Modelle können Fable-5.1-Thinking-Blocks jedoch nicht lesen. Router können inkompatible Blöcke deshalb entfernen. [3]
Das Editieren früherer System-, Tool- oder Message-Inhalte kann spätere Thinking Blocks invalidieren. Anthropic empfiehlt append-only History und Mid-Conversation-System/Tool-Changes. [3][5]
Neue API-Funktionen für lange Agenten
Beta-Funktionen umfassen per-message effort, turn-scoped system messages und lesbare Progress Updates über `thinking.display: "updates"`. [3]
Da Fable 5.1 weniger Status-Text zwischen Tool Calls ausgibt als Fable 5, sollten UIs mit Progress-Narration dieses Verhalten explizit konfigurieren. [3][6]
Verhaltensunterschiede beim Prompting
Parallel Tool Calling ist variabler und kann mehr Turns verursachen. Auf `low` effort sucht Fable 5.1 seltener und antwortet häufiger aus dem Gedächtnis. [3][6]
Anthropic nennt außerdem dichtere Prosa, weniger Formatierung und häufiger unmarkierte Zitate in Dokumentzusammenfassungen. Prompts und Attribution sollten erneut evaluiert werden. [3][6]
Migration von Fable 5
Neben `claude-fable-5` → `claude-fable-5-1` müssen Forced Tool Choice entfernt, Thinking Blocks unverändert zurückgesendet, Historien append-only gehalten und Effort neu kalibriert werden. [5]
Claude Code bietet `/claude-api migrate this project to claude-fable-5-1`, ersetzt aber keine eigenen Regressionstests. [5]
- Model ID aktualisieren
- Forced Tool Use entfernen
- Thinking History nicht rückwirkend editieren
- Router/Fallbacks testen
- Effort neu kalibrieren
- Tool Calls und Latenz messen
- Cache-Kosten neu berechnen
- Eigene Evals ausführen
Fable 5.1 vs Opus 5 vs Sonnet 5
| Modell | Kontext | Max Output | Input | Output | Latenz |
|---|---|---|---|---|---|
| Fable 5.1 | 1M | 128K | $10 | $50 | Slower |
| Opus 5 | 1M | 128K | $5 | $25 | Moderate |
| Sonnet 5 | 1M | 128K | $2 | $10 | Fast |
Anthropic empfiehlt für die meisten Workloads zunächst Opus 5. Fable 5.1 ist für besonders anspruchsvolles Reasoning und Long-Horizon-Agentik gedacht oder wenn Opus-5-Evals nicht ausreichen. [2][3]
Opus 5 kostet $5/$25 pro MTok, also die Hälfte des Fable-Basispreises; Sonnet 5 kostet $2/$10 und ist schneller. Alle drei bieten 1M Kontext und 128K Max Output. [2][4]
Verfügbarkeit und Lifecycle
Fable 5.1 ist über Claude Platform und Partner Clouds verfügbar; Anthropic listet ihn außerdem für Pro-, Max-, Team- und Enterprise-Nutzer. [2][7]
Status: Active (latest), Release 1. September 2026, Retirement nicht vor 1. September 2027. Regionale Preise und Retention können je nach Provider abweichen. [2][8][10]
Was hat sich wirklich verändert?
Fable 5.1 kombiniert günstigeren Cache, bessere Agentic/Research-Werte, Breaking API Changes und strengere Integritätsregeln für Thinking History. [1][3][4]
Es gibt trotzdem keinen belastbaren Grund für die Aussage, Fable 5.1 sei in jedem Task das beste Modell. Anthropic selbst empfiehlt Opus 5 als Startpunkt für die meisten Workloads. [2][3]

