Sortie confirmée le 1er septembre 2026
Anthropic a lancé Fable 5.1 et Mythos 5.1 le 1er septembre 2026. La page modèle marque Fable 5.1 comme Active (latest) et indique une retraite pas avant le 1er septembre 2027. [1][2]
Le modèle est disponible via `claude-fable-5-1` sur Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud et Microsoft Foundry. [2][8][10]
- Claude API : `claude-fable-5-1`
- Bedrock : `anthropic.claude-fable-5-1`
- Statut : Active (latest)
- Release : 1er septembre 2026
Fable 5.1 et Mythos 5.1 : même modèle, safeguards différents
Anthropic indique qu’il s’agit du même modèle sous-jacent. Fable 5.1 est generally available; Mythos 5.1 est limité aux organisations approuvées dans des programmes trusted access comme Project Glasswing. [1][3][9]
Sur Terminal-Bench 4.0, Anthropic rapporte 60,9% pour Mythos 5.1 et 55,8% pour Fable 5.1, écart attribué aux interventions des safeguards. [1]
Spécifications techniques
| Paramètre | Fable 5.1 |
|---|---|
| Contexte | 1M |
| Max output | 128K |
| Thinking | Adaptive, toujours actif |
| Default API effort | high |
| Knowledge cutoff | juin 2026 |
Fable 5.1 offre 1M tokens de contexte par défaut et au maximum, 128K tokens de sortie, input texte+image et output texte. Knowledge cutoff fiable et training cutoff : juin 2026. [2][3]
Adaptive thinking est toujours actif. L’API utilise `high` par défaut; Claude Code aussi, tandis que Claude.ai et Cowork utilisent Medium selon la page de lancement. [1][2][3]
Prix : base inchangée, cache reads -75%
| Modèle | Input / MTok | Cache read / MTok | Output / MTok |
|---|---|---|---|
| Fable 5.1 | $10 | $0.25 | $50 |
| Fable 5 | $10 | $1.00 | $50 |
| Opus 5 | $5 | $0.50 | $25 |
| Sonnet 5 | $2 | $0.20 | $10 |
Prix de base : $10/MTok input et $50/MTok output. Cache write 5 min : $12.50; 1 h : $20. Cache read : $0.25/MTok contre $1.00 pour Fable 5. [3][4]
Le Batch API applique 50% de réduction sur input/output, soit $5/$25 par MTok. [4]
Comment interpréter les 25–45% d’économies annoncées?
Anthropic estime environ 25% d’économie pour un workload typique et jusqu’à environ 45% pour un workload très agentique et fortement basé sur le cache. [1]
Ce n’est pas une baisse générale du tarif de 25–45%. Le calcul repose sur quatre semaines d’usage réel en août 2026 au default effort; l’économie dépend du ratio de cache reads. [1]
- Input/output de base inchangés
- Cache read 75% moins cher
- Environ 25% sur workload typique selon Anthropic
- Jusqu’à ~45% sur workload très agentique selon Anthropic
Benchmarks : forts mais vendor-reported
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 partial | 77.9% | 72.9% | 75.4% | — |
| OSWorld 2.0 strict | 41.7% | 36.1% | 39.6% | — |
| HLE no tools | 60.9% | 57.8% | 56.6% | — |
| HLE with tools | 65.0% | 63.8% | 63.6% | — |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
Anthropic compare Fable 5.1 à Fable 5, Opus 5 et GPT-5.6 Sol. Il s’agit de résultats de lancement Anthropic, pas d’une certification indépendante universelle. [1]
Les safeguards étaient actifs et ont affecté certains scores. OSWorld 2.0 utilise la release de tâches d’août 2026 et n’est pas directement comparable aux anciennes versions. [1]
Terminal-Bench-Science 0.1 : 52,6%
Anthropic rapporte 52,6% pour Fable 5.1 contre 24,7% Fable 5, 29,0% Opus 5 et 22,4% GPT-5.6 Sol. [1]
L’erreur standard annoncée est d’environ ±3,5–4,5 points par modèle, donc les petits écarts ne doivent pas être surinterprétés. [1]
Terminal-Bench 4.0 et différence Fable–Mythos
Fable 5.1 : 55,8%; Mythos 5.1 : 60,9%; Fable 5 : 42,0%; Opus 5 : 52,3%; GPT-5.6 Sol : 37,3%. [1]
Anthropic relie l’écart Mythos/Fable aux interventions des safeguards. Le résultat Mythos ne représente donc pas la configuration publique de Fable. [1]
GDPval-AA, HLE et AutomationBench
GDPval-AA v2 : 1853 pour Fable 5.1, 1723 Fable 5, 1824 Opus 5 et 1711 GPT-5.6 Sol. HLE : 60,9% sans tools et 65,0% avec tools. [1]
AutomationBench : 31,4% contre 17,1% Fable 5 et 26,9% Opus 5. Ce sont des signaux intéressants, pas un substitut aux evals internes. [1]
CursorBench 3.2.0 et OSWorld 2.0
CursorBench 3.2.0 : 73,4% Fable 5.1, 70,5% Fable 5, 70,0% Opus 5, 67,2% GPT-5.6 Sol. Le gain est bien plus modeste que sur Terminal-Bench-Science. [1]
OSWorld 2.0 : 77,9% partial et 41,7% strict. Anthropic déconseille la comparaison directe avec les anciennes releases de tâches. [1]
Effort devient un levier coût/qualité majeur
Selon Anthropic, l’écart avec Fable 5 augmente aux niveaux d’effort élevés, mais Low/Medium peut égaler ou dépasser Fable 5 à moindre coût. [1][3]
L’API beta permet de changer effort par message sans invalider le prompt cache. [3]
Gains clés : agents longs, research et artefacts
Anthropic cite six domaines : coding agentique long, documents/spreadsheets/slides, research/search, vision, long context et computer use. [3]
En entreprise, il faut donc mesurer task completion, retries, tool calls, tokens, temps total et coût par tâche réussie. [3][6]
Recherche scientifique : distinguer Fable et Mythos
Les exemples scientifiques les plus avancés utilisent souvent Mythos 5.1, la variante restreinte. Anthropic décrit notamment des expériences de protein design. [1]
Anthropic rapporte des binders à affinité 10× supérieure à certains meilleurs designs Adaptyv Bio sur trois targets et un hit rate proche de 50% sur 12 targets. Ce sont des résultats Mythos publiés par Anthropic. [1]
Safeguards : moins de faux positifs, pas moins de limites
Anthropic annonce environ 60% de faux positifs cyber en moins. La découverte de vulnérabilités dans le code source est permise, mais exploit development, pentesting et certains scans binaires restent limités. [1][3]
En biologie, les interventions sur questions bénignes de base auraient baissé d’environ 85% depuis le lancement de Fable 5. [1]
Data retention et Enterprise Frontier Safeguards
Fable 5.1 est par défaut un Covered Model avec 30 jours de rétention et sans ZDR standard sauf autorisation explicite. [3]
EFS doit conserver les données de sécurité dans l’infrastructure cloud contrôlée par le client. Anthropic prévoit un rollout progressif plus tard cet automne; AWS documente ses propres modes de rétention. [1][8]
Content provenance : watermark et C2PA
Anthropic applique un watermark statistique au texte généré par Fable 5.1, sans token ou caractère caché supplémentaire selon l’entreprise. [3]
Les fichiers image/vidéo supportés peuvent recevoir des Content Credentials C2PA lorsqu’ils sont récupérés via Files API. [3]
Breaking change : forced tool use non supporté
{
"tool_choice": {"type": "auto"}
}
`tool_choice: any` ou un tool imposé retourne HTTP 400; `auto` et `none` restent supportés. [3][5]
Pour du JSON conforme à un schema, Anthropic recommande strict tool use avec `auto` ou structured outputs. [3]
Thinking blocks : historique append-only
Fable 5.1 lit les anciens thinking blocks, mais les modèles plus anciens ne lisent pas les siens. [3]
Modifier un ancien system prompt, tool ou message peut invalider les thinking blocks suivants. Anthropic recommande un historique append-only et des changements système/tools en cours de conversation. [3][5]
Nouvelles fonctions API pour agents longs
Fable 5.1 ajoute en beta per-message effort, turn-scoped system messages et les progress updates via `thinking.display: "updates"`. [3]
Comme le modèle produit moins de narration entre tool calls que Fable 5, les interfaces qui en dépendent doivent l’activer explicitement. [3][6]
Différences de comportement et prompting
Le parallel tool calling est plus variable et peut augmenter le nombre de turns. À `low` effort, le modèle déclenche moins souvent search/retrieval. [3][6]
La documentation mentionne aussi une prose plus dense, moins de formatage et davantage de citations non marquées dans certains résumés. [3][6]
Migration depuis Fable 5
Au-delà de `claude-fable-5` → `claude-fable-5-1`, retirez le forced tool choice, préservez les thinking blocks, gardez l’historique append-only et recalibrez effort. [5]
Claude Code propose `/claude-api migrate this project to claude-fable-5-1`, mais des tests de régression restent indispensables. [5]
- Mettre à jour model ID
- Retirer forced tool use
- Ne pas réécrire l’historique avec thinking blocks
- Tester routers/fallbacks
- Recalibrer effort
- Mesurer tool calls et latence
- Recalculer coût avec cache read
- Relancer les evals
Fable 5.1 vs Opus 5 vs Sonnet 5
| Modèle | Contexte | Max output | Input | Output | Latence |
|---|---|---|---|---|---|
| Fable 5.1 | 1M | 128K | $10 | $50 | Slower |
| Opus 5 | 1M | 128K | $5 | $25 | Moderate |
| Sonnet 5 | 1M | 128K | $2 | $10 | Fast |
Anthropic recommande Opus 5 comme point de départ pour la majorité des workloads. Fable 5.1 vise reasoning difficile et agents long-horizon quand Opus 5 ne suffit pas dans vos evals. [2][3]
Opus 5 coûte $5/$25 par MTok et Sonnet 5 $2/$10, contre $10/$50 pour Fable 5.1. Les trois ont 1M de contexte et 128K max output. [2][4]
Disponibilité et lifecycle
Fable 5.1 est disponible sur Claude Platform et les principaux clouds partenaires; Anthropic le liste aussi pour Pro, Max, Team et Enterprise. [2][7]
Statut Active (latest), release 1er septembre 2026, retraite pas avant le 1er septembre 2027. Les règles régionales de prix/rétention peuvent varier selon provider. [2][8][10]
Ce qui change réellement
Fable 5.1 combine cache moins cher, meilleurs résultats agentiques/research, breaking changes API et règles plus strictes autour de l’intégrité des thinking blocks. [1][3][4]
Cela ne prouve pas qu’il soit meilleur sur chaque tâche. Anthropic lui-même recommande Opus 5 comme point de départ pour la plupart des workloads. [2][3]

