Claude Fable 5.1: Benchmarks, Preis & Vergleich 2026 | POLPROG Zum Inhalt springen

Claude Fable 5.1 ist da: Benchmarks, Preis, 1M Kontext und Vergleich mit Fable 5, Opus 5 und GPT-5.6 Sol

Am 1. September 2026 hat Anthropic Claude Fable 5.1 und den nur eingeschränkt verfügbaren Claude Mythos 5.1 offiziell veröffentlicht. Fable 5.1 behält die Basispreise von Fable 5 bei, senkt Cache-Reads um 75%, verbessert agentische und wissenschaftliche Benchmarks und bringt relevante API-Breaking-Changes. Dieser Artikel trennt bestätigte Spezifikationen, Anthropic-eigene Benchmarkwerte, methodische Einschränkungen und praktische Migrationsfolgen.

KI
Veröffentlicht Verfasst von Lesezeit 18 Min. Lesezeit

Am 1. September 2026 hat Anthropic Claude Fable 5.1 und den nur eingeschränkt verfügbaren Claude Mythos 5.1 offiziell veröffentlicht. Fable 5.1 behält die Basispreise von Fable 5 bei, senkt Cache-Reads um 75%, verbessert agentische und wissenschaftliche Benchmarks und bringt relevante API-Breaking-Changes. Dieser Artikel trennt bestätigte Spezifikationen, Anthropic-eigene Benchmarkwerte, methodische Einschränkungen und praktische Migrationsfolgen.

Auf dieser Seite
  1. 1Release bestätigt: Fable 5.1 erschien am 1. September 2026
  2. 2Fable 5.1 und Mythos 5.1: dasselbe Modell, andere Safeguards
  3. 3Technische Spezifikation
  4. 4Preis: Basis unverändert, Cache Reads 75% günstiger
  5. 5Was bedeuten die 25–45% Kosteneinsparung wirklich?
  6. 6Benchmark-Tabelle: stark, aber vendor-reported
  7. 7Terminal-Bench-Science 0.1: 52,6%
  8. 8Terminal-Bench 4.0 und Fable vs Mythos
  9. 9GDPval-AA, HLE und AutomationBench
  10. 10CursorBench 3.2.0 und OSWorld 2.0
  11. 11Effort als Kosten- und Qualitätsregler
  12. 12Capability Gains: lange Agentenläufe, Research und Artefakte
  13. 13Scientific Research: Fable und Mythos sauber trennen
  14. 14Safeguards: weniger False Positives, weiterhin Grenzen
  15. 15Data Retention und Enterprise Frontier Safeguards
  16. 16Content Provenance: Text-Watermark und C2PA
  17. 17Breaking Change: Forced Tool Use nicht unterstützt
  18. 18Thinking Blocks verlangen Append-only History
  19. 19Neue API-Funktionen für lange Agenten
  20. 20Verhaltensunterschiede beim Prompting
  21. 21Migration von Fable 5
  22. 22Fable 5.1 vs Opus 5 vs Sonnet 5
  23. 23Verfügbarkeit und Lifecycle
  24. 24Was hat sich wirklich verändert?

Release bestätigt: Fable 5.1 erschien am 1. September 2026

Anthropic veröffentlichte Claude Fable 5.1 und Claude Mythos 5.1 am 1. September 2026. Die offizielle Modellseite markiert Fable 5.1 als Active (latest) und nennt als frühestmögliches Retirement den 1. September 2027. [1][2]

Das Modell ist als `claude-fable-5-1` in der Claude API verfügbar sowie über Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry. AWS und Google bestätigten die Verfügbarkeit am selben Tag. [2][8][10]

  • Claude API: `claude-fable-5-1`
  • Bedrock: `anthropic.claude-fable-5-1`
  • Status: Active (latest)
  • Release: 1. September 2026

Fable 5.1 und Mythos 5.1: dasselbe Modell, andere Safeguards

Anthropic beschreibt Fable 5.1 und Mythos 5.1 als dasselbe underlying model. Fable 5.1 ist allgemein verfügbar, Mythos 5.1 nur für genehmigte Organisationen in Trusted-Access-Programmen wie Project Glasswing. [1][3][9]

Das ist für Benchmark-Interpretation wichtig: Auf Terminal-Bench 4.0 meldet Anthropic 60,9% für Mythos 5.1 und 55,8% für Fable 5.1 und führt den Abstand auf Safeguard-Eingriffe zurück. [1]

Technische Spezifikation

ParameterFable 5.1
Kontext1M
Max Output128K
ThinkingAdaptive, immer an
Default API Efforthigh
Knowledge CutoffJuni 2026

Fable 5.1 bietet 1M Token Kontext als Default und Maximum, maximal 128K Output-Tokens, Text- und Bildeingabe sowie Textausgabe. Reliable Knowledge Cutoff und Training Cutoff sind Juni 2026. [2][3]

Adaptive Thinking ist immer aktiv. Die API-Dokumentation nennt `high` als Default Effort; Claude Code startet ebenfalls mit High, Claude.ai und Cowork laut Launch-Seite mit Medium. [1][2][3]

Preis: Basis unverändert, Cache Reads 75% günstiger

ModellInput / MTokCache Read / MTokOutput / MTok
Fable 5.1$10$0.25$50
Fable 5$10$1.00$50
Opus 5$5$0.50$25
Sonnet 5$2$0.20$10

Die Basispreise bleiben $10/MTok Input und $50/MTok Output. Ein 5-Minuten-Cache-Write kostet $12.50/MTok, ein 1-Stunden-Write $20/MTok. Cache Reads kosten nur noch $0.25/MTok statt $1.00 bei Fable 5. [3][4]

Batch API reduziert Basis-Input und -Output um 50% auf $5/$25 pro MTok. [4]

Was bedeuten die 25–45% Kosteneinsparung wirklich?

Anthropic schätzt rund 25% niedrigere Gesamtkosten für typische tokenbasierte Workloads und bis zu etwa 45% für stark agentische, cache-intensive Workflows. [1]

Das ist keine generelle Listenpreisreduktion. Die Schätzung basiert laut Anthropic auf vier Wochen tatsächlicher Nutzung im August 2026 bei Default Effort und hängt stark vom Cache-Anteil ab. [1]

  • Input/Output-Basispreise unverändert
  • Cache Read 75% günstiger
  • Typisch ca. 25% Einsparung laut Anthropic
  • Highly agentic bis ca. 45% laut Anthropic

Benchmark-Tabelle: stark, aber vendor-reported

BenchmarkFable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8%42.0%52.3%37.3%
GDPval-AA v21853172318241711
OSWorld 2.0 partial77.9%72.9%75.4%
OSWorld 2.0 strict41.7%36.1%39.6%
HLE no tools60.9%57.8%56.6%
HLE with tools65.0%63.8%63.6%
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

Anthropic vergleicht Fable 5.1 mit Fable 5, Opus 5 und GPT-5.6 Sol. Diese Ergebnisse stammen aus Anthropics Launch-Setup und sind kein unabhängiger Nachweis universeller Überlegenheit. [1]

Safeguards waren aktiv und beeinflussten einige Scores. OSWorld 2.0 nutzt die August-2026-Aufgabenversion und ist nicht direkt mit älteren Veröffentlichungen vergleichbar. [1]

Terminal-Bench-Science 0.1: 52,6%

Anthropic meldet 52,6% für Fable 5.1 gegenüber 24,7% Fable 5, 29,0% Opus 5 und 22,4% GPT-5.6 Sol. In genau diesem Setup ist der Wert mehr als doppelt so hoch wie bei Fable 5. [1]

Der angegebene Standardfehler liegt bei etwa ±3,5–4,5 Punkten pro Modell. Kleine Abstände sollten daher nicht überinterpretiert werden. [1]

Terminal-Bench 4.0 und Fable vs Mythos

Fable 5.1 erreicht 55,8%, Mythos 5.1 60,9%, Fable 5 42,0%, Opus 5 52,3% und GPT-5.6 Sol 37,3%. [1]

Anthropic erklärt den höheren Mythos-Wert mit weniger restriktiven Safeguards. Mythos 5.1 ist daher nicht der Score der allgemein verfügbaren Fable-Konfiguration. [1]

GDPval-AA, HLE und AutomationBench

GDPval-AA v2: Fable 5.1 1853, Fable 5 1723, Opus 5 1824, GPT-5.6 Sol 1711. Humanity’s Last Exam: 60,9% ohne Tools und 65,0% mit Tools für Fable 5.1. [1]

AutomationBench liegt bei 31,4% für Fable 5.1 gegenüber 17,1% Fable 5 und 26,9% Opus 5. Das unterstützt die Agentic-Workload-Positionierung, ersetzt aber keine internen Evals. [1]

CursorBench 3.2.0 und OSWorld 2.0

CursorBench 3.2.0: Fable 5.1 73,4%, Fable 5 70,5%, Opus 5 70,0%, GPT-5.6 Sol 67,2%. Der Abstand ist hier deutlich kleiner als auf Terminal-Bench-Science. [1]

OSWorld 2.0: 77,9% partial und 41,7% strict für Fable 5.1. Anthropic warnt vor direktem Vergleich mit älteren OSWorld-Releases. [1]

Effort als Kosten- und Qualitätsregler

Anthropic sagt, dass der Vorsprung von Fable 5.1 bei höherem Effort am größten ist. Gleichzeitig kann Low oder Medium Fable-5-Niveau oder besser zu geringeren Kosten erreichen. [1][3]

Per-message effort kann in der API betaweise während der Unterhaltung geändert werden, ohne den Prompt Cache zu invalidieren. [3]

Capability Gains: lange Agentenläufe, Research und Artefakte

Die Dokumentation nennt sechs Schwerpunktbereiche: Long-Session Agentic Coding, Dokumente/Spreadsheets/Slides, Research und Search, Vision, Long Context und Computer Use. [3]

Für Enterprise-Evals sind deshalb Task Completion, Tool Calls, Retries, Tokens, Wall-Clock-Zeit und Cost per Successful Task wichtiger als ein einzelner Benchmark. [3][6]

Scientific Research: Fable und Mythos sauber trennen

Viele der anspruchsvollsten Forschungsbeispiele im Launch beziehen sich auf Mythos 5.1, die eingeschränkt verfügbare Variante. Anthropic beschreibt unter anderem Protein-Design und autonome Forschungsschleifen. [1]

Anthropic meldet bei drei Targets Binder mit 10× höherer Affinität als die besten Designs bestimmter Adaptyv-Bio-Wettbewerbe und nahezu 50% Hit Rate über 12 Targets. Das sind Anthropic-reported Mythos-Ergebnisse, nicht automatisch öffentliche Fable-Fähigkeiten. [1]

Safeguards: weniger False Positives, weiterhin Grenzen

Anthropic meldet rund 60% weniger Cybersecurity-False-Positives. Source-Code-Vulnerability-Discovery ist nun zulässig, während Exploit Development, Pentesting und binärbasierte Scans je nach Kategorie weiterhin begrenzt werden. [1][3]

Bei harmlosen Grundlagenfragen zu Biologie und Medizin sollen die Interventionen gegenüber dem Fable-5-Launch um etwa 85% gesunken sein. [1]

Data Retention und Enterprise Frontier Safeguards

Fable 5.1 ist standardmäßig ein Covered Model mit 30 Tagen Retention und ohne reguläres ZDR, sofern Anthropic keinen ausdrücklichen Ausnahmezugang genehmigt. [3]

EFS soll Sicherheitsdaten in kundenseitig kontrollierter Cloud-Infrastruktur halten. Anthropic plant einen stufenweisen Rollout später im Herbst; AWS dokumentiert zusätzlich provider-spezifische Retention-Modi. [1][8]

Content Provenance: Text-Watermark und C2PA

Fable-5.1-Text trägt laut Anthropic auf allen unterstützten Plattformen ein statistisches Watermark, ohne zusätzliche Tokens oder versteckte Zeichen. [3]

Unterstützte Bild- und Videodateien können beim Abruf über die Files API signierte C2PA Content Credentials erhalten. [3]

Breaking Change: Forced Tool Use nicht unterstützt

{
  "tool_choice": {"type": "auto"}
}

`tool_choice` mit `any` oder einem erzwungenen Tool liefert HTTP 400. `auto` und `none` bleiben unterstützt. [3][5]

Für validiertes JSON empfiehlt Anthropic Strict Tool Use mit `auto` oder Structured Outputs. [3]

Thinking Blocks verlangen Append-only History

Fable 5.1 kann ältere Thinking Blocks lesen, ältere Modelle können Fable-5.1-Thinking-Blocks jedoch nicht lesen. Router können inkompatible Blöcke deshalb entfernen. [3]

Das Editieren früherer System-, Tool- oder Message-Inhalte kann spätere Thinking Blocks invalidieren. Anthropic empfiehlt append-only History und Mid-Conversation-System/Tool-Changes. [3][5]

Neue API-Funktionen für lange Agenten

Beta-Funktionen umfassen per-message effort, turn-scoped system messages und lesbare Progress Updates über `thinking.display: "updates"`. [3]

Da Fable 5.1 weniger Status-Text zwischen Tool Calls ausgibt als Fable 5, sollten UIs mit Progress-Narration dieses Verhalten explizit konfigurieren. [3][6]

Verhaltensunterschiede beim Prompting

Parallel Tool Calling ist variabler und kann mehr Turns verursachen. Auf `low` effort sucht Fable 5.1 seltener und antwortet häufiger aus dem Gedächtnis. [3][6]

Anthropic nennt außerdem dichtere Prosa, weniger Formatierung und häufiger unmarkierte Zitate in Dokumentzusammenfassungen. Prompts und Attribution sollten erneut evaluiert werden. [3][6]

Migration von Fable 5

Neben `claude-fable-5` → `claude-fable-5-1` müssen Forced Tool Choice entfernt, Thinking Blocks unverändert zurückgesendet, Historien append-only gehalten und Effort neu kalibriert werden. [5]

Claude Code bietet `/claude-api migrate this project to claude-fable-5-1`, ersetzt aber keine eigenen Regressionstests. [5]

  • Model ID aktualisieren
  • Forced Tool Use entfernen
  • Thinking History nicht rückwirkend editieren
  • Router/Fallbacks testen
  • Effort neu kalibrieren
  • Tool Calls und Latenz messen
  • Cache-Kosten neu berechnen
  • Eigene Evals ausführen

Fable 5.1 vs Opus 5 vs Sonnet 5

ModellKontextMax OutputInputOutputLatenz
Fable 5.11M128K$10$50Slower
Opus 51M128K$5$25Moderate
Sonnet 51M128K$2$10Fast

Anthropic empfiehlt für die meisten Workloads zunächst Opus 5. Fable 5.1 ist für besonders anspruchsvolles Reasoning und Long-Horizon-Agentik gedacht oder wenn Opus-5-Evals nicht ausreichen. [2][3]

Opus 5 kostet $5/$25 pro MTok, also die Hälfte des Fable-Basispreises; Sonnet 5 kostet $2/$10 und ist schneller. Alle drei bieten 1M Kontext und 128K Max Output. [2][4]

Verfügbarkeit und Lifecycle

Fable 5.1 ist über Claude Platform und Partner Clouds verfügbar; Anthropic listet ihn außerdem für Pro-, Max-, Team- und Enterprise-Nutzer. [2][7]

Status: Active (latest), Release 1. September 2026, Retirement nicht vor 1. September 2027. Regionale Preise und Retention können je nach Provider abweichen. [2][8][10]

Was hat sich wirklich verändert?

Fable 5.1 kombiniert günstigeren Cache, bessere Agentic/Research-Werte, Breaking API Changes und strengere Integritätsregeln für Thinking History. [1][3][4]

Es gibt trotzdem keinen belastbaren Grund für die Aussage, Fable 5.1 sei in jedem Task das beste Modell. Anthropic selbst empfiehlt Opus 5 als Startpunkt für die meisten Workloads. [2][3]

Claude Fable 5.1 ist ein bestätigtes Release vom 1. September 2026. Entscheidend ist die Kombination aus stärkerer Long-Horizon-Agentik, 1M Kontext, sehr günstigen Cache-Reads und einem anspruchsvolleren API-Verhaltensmodell. Da reguläre Input- und Output-Tokens weiterhin doppelt so teuer wie bei Opus 5 sind, ist Fable 5.1 vor allem dann sinnvoll, wenn eigene Evals den Mehrpreis rechtfertigen.

AI Claude Fable 5.1 Anthropic Benchmarks Coding AI Agents API

Häufig gestellte Fragen

Ist Claude Fable 5.1 wirklich heute erschienen?

Ja. Anthropic veröffentlichte Fable 5.1 am 1. September 2026. [1][2]

Wie lautet die Model ID?

claude-fable-5-1 in der Claude API. [2][3]

Wie groß ist der Kontext?

1M Tokens. [2][3]

Wie groß ist der maximale Output?

128K Tokens. [2]

Was kostet Fable 5.1?

$10/MTok Input, $50/MTok Output und $0.25/MTok Cache Read. [4]

Ist Fable 5.1 günstiger als Fable 5?

Basispreise sind gleich, Cache Reads sind viermal günstiger. Anthropic schätzt ca. 25% typische und bis zu ca. 45% agentische Gesamtersparnis. [1][4]

Ist Fable 5.1 besser als Opus 5?

In vielen Anthropic-Launch-Benchmarks ja, aber nicht garantiert für jeden Task. Opus 5 bleibt Anthropics Startempfehlung für die meisten Workloads. [1][2]

Sind Fable 5.1 und Mythos 5.1 dasselbe Modell?

Ja, dasselbe zugrunde liegende Modell mit unterschiedlichen Safeguards und Zugangsregeln. [1][3]

Kann Adaptive Thinking deaktiviert werden?

Nein. Es ist immer aktiv. [3][5]

Funktioniert Forced Tool Use?

Nein. Erzwungene Tool-Choice-Typen liefern 400. [3]

Müssen Prompts angepasst werden?

Meist nicht grundlegend, aber Tool-Batching, Progress, Low-Effort-Search und Zitierverhalten sollten erneut getestet werden. [6]

Hat Fable 5.1 ein Watermark?

Ja, statistisches Text-Watermark; unterstützte Medien können C2PA Credentials erhalten. [3]

Gibt es Zero Data Retention?

Standardmäßig 30 Tage Retention; ZDR nur mit ausdrücklicher Autorisierung bzw. speziellen Enterprise-Regelungen. [1][3][8]

Sind die Benchmarks unabhängig bestätigt?

Die Launch-Tabelle ist Anthropic-reported und sollte entsprechend gekennzeichnet werden. [1]

Lohnt sich die Migration?

Für Long-Horizon- und Cache-heavy-Agenten ist ein POC sinnvoll, aber API-Breaking-Changes und eigene Evals müssen berücksichtigt werden. [3][5]

Quellen und Referenzen

  1. Anthropic, Introducing Claude Fable 5.1 and Claude Mythos 5.11234567891011121314151617181920212223242526272829
  2. Claude Platform Docs, Claude Fable 5.1 overview1234567891011121314
  3. Claude Platform Docs, What's new in Claude Fable 5.112345678910111213141516171819202122232425262728293031
  4. Claude Platform Docs, Pricing123456
  5. Claude Platform Docs, Migrating to Claude Fable 5.1 and Claude Mythos 5.1123456
  6. Claude Platform Docs, Prompting Claude Fable 5.112345
  7. Claude Platform Docs, Claude Fable 5 overview
  8. AWS, Introducing Claude Fable 5.1 on AWS1234
  9. Anthropic, Project Glasswing
  10. Google Cloud, Claude Fable 5.112
  11. VentureBeat, Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache readsweiterführendes Material

War das hilfreich?

Neue Artikel per E-Mail erhalten

Eine kurze E-Mail pro neuem Wissens-Artikel. Kein Spam, Abmeldung mit einem Klick.

Wir nutzen Ihre E-Mail nur, um neue Artikel zu versenden. Keine Weitergabe an Dritte.

Zurück zu Wissen