Claude Fable 5.1: benchmark, prezzo e confronto 2026 | POLPROG Vai al contenuto

Claude Fable 5.1 è disponibile: benchmark, prezzo, contesto 1M e confronto con Fable 5, Opus 5 e GPT-5.6 Sol

Il 1° settembre 2026 Anthropic ha rilasciato ufficialmente Claude Fable 5.1 e Claude Mythos 5.1 ad accesso limitato. Fable 5.1 mantiene il prezzo base di Fable 5, riduce del 75% il costo dei cache read, migliora benchmark agentic e di ricerca e introduce breaking changes significativi nell’API. Questa analisi separa specifiche confermate, risultati Anthropic-reported, limiti metodologici e conseguenze pratiche della migrazione.

IA
Pubblicato Scritto da Tempo di lettura 18 min di lettura

Il 1° settembre 2026 Anthropic ha rilasciato ufficialmente Claude Fable 5.1 e Claude Mythos 5.1 ad accesso limitato. Fable 5.1 mantiene il prezzo base di Fable 5, riduce del 75% il costo dei cache read, migliora benchmark agentic e di ricerca e introduce breaking changes significativi nell’API. Questa analisi separa specifiche confermate, risultati Anthropic-reported, limiti metodologici e conseguenze pratiche della migrazione.

In questa pagina
  1. 1Release confermato: 1° settembre 2026
  2. 2Fable 5.1 e Mythos 5.1: stesso modello, safeguards diversi
  3. 3Specifiche tecniche
  4. 4Prezzo: base invariata, cache read -75%
  5. 5Come leggere il risparmio 25–45%
  6. 6Benchmark: forti ma vendor-reported
  7. 7Terminal-Bench-Science 0.1: 52,6%
  8. 8Terminal-Bench 4.0 e Fable vs Mythos
  9. 9GDPval-AA, HLE e AutomationBench
  10. 10CursorBench 3.2.0 e OSWorld 2.0
  11. 11Effort come leva costo/qualità
  12. 12Capability gains: agenti lunghi, research e artefatti
  13. 13Scientific research: distinguere Fable da Mythos
  14. 14Safeguards: meno false positives, limiti ancora presenti
  15. 15Data retention ed Enterprise Frontier Safeguards
  16. 16Content provenance: watermark e C2PA
  17. 17Breaking change: forced tool use non supportato
  18. 18Thinking blocks: history append-only
  19. 19Nuove funzioni API per agenti lunghi
  20. 20Differenze comportamentali e prompting
  21. 21Migrazione da Fable 5
  22. 22Fable 5.1 vs Opus 5 vs Sonnet 5
  23. 23Disponibilità e lifecycle
  24. 24Cosa è cambiato davvero

Release confermato: 1° settembre 2026

Anthropic ha rilasciato Fable 5.1 e Mythos 5.1 il 1° settembre 2026. La pagina ufficiale marca Fable 5.1 come Active (latest) e retirement non prima del 1° settembre 2027. [1][2]

Disponibile come `claude-fable-5-1` su Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud e Microsoft Foundry. [2][8][10]

  • Claude API: `claude-fable-5-1`
  • Bedrock: `anthropic.claude-fable-5-1`
  • Stato: Active (latest)
  • Release: 1° settembre 2026

Fable 5.1 e Mythos 5.1: stesso modello, safeguards diversi

Anthropic dichiara che sono lo stesso underlying model. Fable 5.1 è generally available, Mythos 5.1 solo per organizzazioni approvate in programmi trusted access come Project Glasswing. [1][3][9]

Terminal-Bench 4.0 mostra 60,9% Mythos 5.1 vs 55,8% Fable 5.1; Anthropic attribuisce il gap alle safeguard interventions. [1]

Specifiche tecniche

ParametroFable 5.1
Contesto1M
Max output128K
ThinkingAdaptive, sempre attivo
Default API efforthigh
Knowledge cutoffgiugno 2026

Contesto 1M default e maximum, max output 128K, input testo+immagini, output testo. Reliable knowledge cutoff e training cutoff: giugno 2026. [2][3]

Adaptive thinking è sempre attivo. Default effort API `high`; Claude Code High, Claude.ai/Cowork Medium secondo il lancio. [1][2][3]

Prezzo: base invariata, cache read -75%

ModelloInput / MTokCache read / MTokOutput / MTok
Fable 5.1$10$0.25$50
Fable 5$10$1.00$50
Opus 5$5$0.50$25
Sonnet 5$2$0.20$10

Base $10/MTok input e $50/MTok output. Cache write 5 min $12.50, 1 h $20. Cache read $0.25/MTok contro $1.00 di Fable 5. [3][4]

Batch API: 50% di sconto su input/output, cioè $5/$25. [4]

Come leggere il risparmio 25–45%

Anthropic stima ~25% meno costo per workload tipici e fino a ~45% per workflow molto agentic e cache-heavy. [1]

Non è un taglio universale del listino. La stima usa quattro settimane di uso reale di agosto 2026 a default effort e dipende dalla quota di cache reads. [1]

  • Base input/output invariata
  • Cache read 75% più economico
  • ~25% typical workload secondo Anthropic
  • Fino a ~45% highly agentic secondo Anthropic

Benchmark: forti ma vendor-reported

BenchmarkFable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8%42.0%52.3%37.3%
GDPval-AA v21853172318241711
OSWorld 2.0 partial77.9%72.9%75.4%
OSWorld 2.0 strict41.7%36.1%39.6%
HLE no tools60.9%57.8%56.6%
HLE with tools65.0%63.8%63.6%
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

Anthropic confronta Fable 5.1 con Fable 5, Opus 5 e GPT-5.6 Sol. Sono risultati di lancio Anthropic, non certificazione indipendente. [1]

Safeguards attivi hanno influenzato alcuni score. OSWorld 2.0 usa la release task agosto 2026 e non è direttamente comparabile con vecchi risultati. [1]

Terminal-Bench-Science 0.1: 52,6%

Fable 5.1 52,6% vs Fable 5 24,7%, Opus 5 29,0%, GPT-5.6 Sol 22,4%. [1]

Standard error dichiarato circa ±3,5–4,5 punti per modello: differenze piccole non vanno sovrainterpretate. [1]

Terminal-Bench 4.0 e Fable vs Mythos

Fable 5.1 55,8%; Mythos 5.1 60,9%; Fable 5 42,0%; Opus 5 52,3%; GPT-5.6 Sol 37,3%. [1]

Anthropic collega il gap Mythos/Fable ai safeguards. Mythos non è il punteggio della configurazione pubblica Fable. [1]

GDPval-AA, HLE e AutomationBench

GDPval-AA v2: 1853 Fable 5.1, 1723 Fable 5, 1824 Opus 5, 1711 GPT-5.6 Sol. HLE: 60,9% senza tools e 65,0% con tools. [1]

AutomationBench: 31,4% Fable 5.1 vs 17,1% Fable 5 e 26,9% Opus 5. Segnali utili, non sostitutivi degli eval interni. [1]

CursorBench 3.2.0 e OSWorld 2.0

CursorBench: 73,4% Fable 5.1, 70,5% Fable 5, 70,0% Opus 5, 67,2% GPT-5.6 Sol. [1]

OSWorld 2.0: 77,9% partial, 41,7% strict; Anthropic specifica che il task release agosto 2026 non è direttamente comparabile con le versioni precedenti. [1]

Effort come leva costo/qualità

Il vantaggio su Fable 5 cresce a effort elevato, ma Low/Medium può eguagliare o superare Fable 5 a costo inferiore secondo Anthropic. [1][3]

In beta l’effort può cambiare per messaggio senza invalidare prompt cache. [3]

Capability gains: agenti lunghi, research e artefatti

Sei aree: agentic coding lungo, documenti/spreadsheet/slides, research/search, vision, long context e computer use. [3]

Gli eval enterprise dovrebbero misurare task completion, retries, tool calls, token, wall-clock time e cost per successful task. [3][6]

Scientific research: distinguere Fable da Mythos

Gli esempi scientifici più avanzati spesso usano Mythos 5.1, la variante ristretta. [1]

Anthropic riporta binders con affinità 10× superiore a determinati migliori design Adaptyv Bio su tre target e hit rate quasi 50% su 12 target. Sono risultati Mythos Anthropic-reported. [1]

Safeguards: meno false positives, limiti ancora presenti

Anthropic dichiara ~60% meno false positives cyber. Vulnerability discovery nel source code è permesso; exploit development, pentesting e alcuni binary scan restano limitati. [1][3]

Per domande benign di biologia/medicina di base, le intervention sarebbero diminuite di ~85% rispetto al launch di Fable 5. [1]

Data retention ed Enterprise Frontier Safeguards

Fable 5.1 è un Covered Model con retention 30 giorni e senza ZDR standard salvo autorizzazione esplicita. [3]

EFS mira a mantenere dati di sicurezza in cloud infrastructure controllata dal cliente. Rollout a fasi più avanti in autunno; AWS documenta regole provider-specific. [1][8]

Content provenance: watermark e C2PA

Il testo Fable 5.1 contiene un watermark statistico Anthropic senza token o caratteri nascosti aggiuntivi, secondo Anthropic. [3]

File image/video supportati possono ricevere C2PA Content Credentials tramite Files API. [3]

Breaking change: forced tool use non supportato

{
  "tool_choice": {"type": "auto"}
}

`tool_choice` `any` o tool specifico forzato restituisce HTTP 400; `auto` e `none` restano supportati. [3][5]

Per JSON schema-valid Anthropic consiglia strict tool use con `auto` o structured outputs. [3]

Thinking blocks: history append-only

Fable 5.1 legge thinking blocks di modelli precedenti, ma i modelli precedenti non leggono i suoi. [3]

Modificare system, tools o messaggi precedenti può invalidare thinking blocks successivi. Anthropic raccomanda history append-only e mid-conversation changes. [3][5]

Nuove funzioni API per agenti lunghi

Beta: per-message effort, turn-scoped system messages e progress updates con `thinking.display: "updates"`. [3]

Poiché Fable 5.1 emette meno status text tra tool calls, UI che dipendono da progress narration devono abilitarla esplicitamente. [3][6]

Differenze comportamentali e prompting

Parallel tool calling è più variabile e può richiedere più turn. A `low` effort il modello cerca meno spesso. [3][6]

La documentazione nota prosa più densa, meno formatting e più citazioni non marcate in alcuni summary. [3][6]

Migrazione da Fable 5

Oltre a `claude-fable-5` → `claude-fable-5-1`, rimuovi forced tool choice, conserva thinking blocks, mantieni history append-only e ricalibra effort. [5]

Claude Code offre `/claude-api migrate this project to claude-fable-5-1`, ma servono comunque regression test propri. [5]

  • Aggiornare model ID
  • Rimuovere forced tool use
  • Non riscrivere history con thinking blocks
  • Testare router/fallback
  • Ricalibrare effort
  • Misurare tool calls/latency
  • Ricalcolare cache cost
  • Rieseguire eval

Fable 5.1 vs Opus 5 vs Sonnet 5

ModelloContestoMax outputInputOutputLatenza
Fable 5.11M128K$10$50Slower
Opus 51M128K$5$25Moderate
Sonnet 51M128K$2$10Fast

Anthropic consiglia Opus 5 come punto di partenza per la maggior parte dei workload. Fable 5.1 è per reasoning molto difficile e long-horizon agents quando Opus 5 non basta nei vostri eval. [2][3]

Opus 5 costa $5/$25 e Sonnet 5 $2/$10 contro $10/$50 di Fable 5.1. Tutti hanno 1M context e 128K max output. [2][4]

Disponibilità e lifecycle

Disponibile su Claude Platform e principali partner cloud; Anthropic lo elenca anche per Pro, Max, Team ed Enterprise. [2][7]

Active (latest), release 1° settembre 2026, retirement non prima del 1° settembre 2027. Prezzi e retention regionali possono cambiare per provider. [2][8][10]

Cosa è cambiato davvero

Fable 5.1 combina cache più economico, migliori risultati agentic/research, breaking changes API e regole più severe per l’integrità dei thinking blocks. [1][3][4]

Non dimostra superiorità universale. Anthropic stesso consiglia Opus 5 come start per la maggior parte dei workload. [2][3]

Claude Fable 5.1 è un release reale del 1° settembre 2026. Il valore principale è la combinazione di agenti long-horizon più forti, contesto 1M, cache molto meno costoso e un modello operativo più rigoroso. Poiché i token input/output normali costano ancora il doppio di Opus 5, il premium va giustificato con eval proprietari e costo per task riuscito.

AI Claude Fable 5.1 Anthropic Benchmarks Coding AI Agents API

Domande frequenti

Claude Fable 5.1 è uscito davvero oggi?

Sì, il 1° settembre 2026. [1][2]

Qual è il model ID?

claude-fable-5-1. [2][3]

Quanto è grande il context?

1M token. [2][3]

Max output?

128K token. [2]

Prezzo?

$10/MTok input, $50/MTok output, $0.25/MTok cache read. [4]

È più economico di Fable 5?

Base uguale, cache read quattro volte meno caro; Anthropic stima ~25% tipico e fino a ~45% agentic. [1][4]

È migliore di Opus 5?

In molti benchmark di lancio sì, ma non è garantito per ogni task; Opus 5 resta lo start consigliato. [1][2]

Fable 5.1 e Mythos 5.1 sono lo stesso modello?

Sì, stesso underlying model con safeguards/accesso differenti. [1][3]

Adaptive thinking si può disattivare?

No. [3][5]

Forced tool use funziona?

No, restituisce errore 400. [3]

Serve cambiare i prompt?

Non tutti, ma tool batching, progress, low-effort search e quoting vanno rivalutati. [6]

Ha watermark?

Sì per il testo; alcuni media supportati ricevono C2PA. [3]

Supporta ZDR?

Non di default; retention 30 giorni salvo autorizzazione o programma enterprise specifico. [1][3][8]

Benchmark indipendenti?

La tabella di lancio è Anthropic-reported. [1]

Conviene migrare?

POC sensato per agenti long-horizon/cache-heavy, ma bisogna gestire breaking changes e rifare gli eval. [3][5]

Fonti e riferimenti

  1. Anthropic, Introducing Claude Fable 5.1 and Claude Mythos 5.11234567891011121314151617181920212223242526272829
  2. Claude Platform Docs, Claude Fable 5.1 overview1234567891011121314
  3. Claude Platform Docs, What's new in Claude Fable 5.112345678910111213141516171819202122232425262728293031
  4. Claude Platform Docs, Pricing123456
  5. Claude Platform Docs, Migrating to Claude Fable 5.1 and Claude Mythos 5.1123456
  6. Claude Platform Docs, Prompting Claude Fable 5.112345
  7. Claude Platform Docs, Claude Fable 5 overview
  8. AWS, Introducing Claude Fable 5.1 on AWS1234
  9. Anthropic, Project Glasswing
  10. Google Cloud, Claude Fable 5.112
  11. VentureBeat, Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache readsletture di approfondimento

È stato utile?

Ricevi i nuovi articoli via e-mail

Una breve e-mail per ogni nuovo articolo di Formazione. Niente spam, disiscriviti con un clic.

Usiamo la tua e-mail solo per inviare nuovi articoli. Nessuna condivisione con terze parti.

Torna alla Formazione