Lanzamiento confirmado: 1 de septiembre de 2026
Anthropic lanzó Fable 5.1 y Mythos 5.1 el 1 de septiembre de 2026. La ficha oficial marca Fable 5.1 como Active (latest) y retirement no antes del 1 de septiembre de 2027. [1][2]
Está disponible como `claude-fable-5-1` en Claude API y en Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry. [2][8][10]
- Claude API: `claude-fable-5-1`
- Bedrock: `anthropic.claude-fable-5-1`
- Estado: Active (latest)
- Release: 1 de septiembre de 2026
Fable 5.1 y Mythos 5.1: mismo modelo, safeguards distintos
Anthropic afirma que ambos usan el mismo underlying model. Fable 5.1 es generally available y Mythos 5.1 solo para organizaciones aprobadas en programas trusted access como Project Glasswing. [1][3][9]
En Terminal-Bench 4.0 Mythos 5.1 obtiene 60,9% y Fable 5.1 55,8%; Anthropic atribuye la diferencia a intervenciones de safeguards. [1]
Especificaciones técnicas
| Parámetro | Fable 5.1 |
|---|---|
| Contexto | 1M |
| Max output | 128K |
| Thinking | Adaptive, siempre activo |
| Default API effort | high |
| Knowledge cutoff | junio 2026 |
Fable 5.1 ofrece contexto 1M como default y maximum, hasta 128K output, entrada texto+imagen y salida texto. Knowledge cutoff fiable y training cutoff: junio de 2026. [2][3]
Adaptive thinking siempre está activado. La API usa `high` como default effort; Claude Code también High, mientras Claude.ai y Cowork usan Medium según el lanzamiento. [1][2][3]
Precio: base igual, cache reads 75% más baratos
| Modelo | Input / MTok | Cache read / MTok | Output / MTok |
|---|---|---|---|
| Fable 5.1 | $10 | $0.25 | $50 |
| Fable 5 | $10 | $1.00 | $50 |
| Opus 5 | $5 | $0.50 | $25 |
| Sonnet 5 | $2 | $0.20 | $10 |
Base: $10/MTok input y $50/MTok output. Cache write 5 min: $12.50; 1 h: $20. Cache read: $0.25/MTok frente a $1.00 en Fable 5. [3][4]
Batch API ofrece 50% de descuento en input/output: $5/$25 por MTok. [4]
Qué significan realmente los ahorros del 25–45%
Anthropic estima alrededor de 25% menos coste en workloads típicos y hasta ~45% en workflows muy agentic y cache-heavy. [1]
No es una rebaja general del list price. La estimación usa cuatro semanas de uso real de agosto de 2026 a default effort y depende del porcentaje de cache reads. [1]
- Base input/output sin cambios
- Cache read 75% más barato
- ~25% en workload típico según Anthropic
- Hasta ~45% en highly agentic según Anthropic
Benchmarks: fuertes, pero vendor-reported
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 partial | 77.9% | 72.9% | 75.4% | — |
| OSWorld 2.0 strict | 41.7% | 36.1% | 39.6% | — |
| HLE no tools | 60.9% | 57.8% | 56.6% | — |
| HLE with tools | 65.0% | 63.8% | 63.6% | — |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
Anthropic compara Fable 5.1 con Fable 5, Opus 5 y GPT-5.6 Sol. Son resultados del setup de lanzamiento de Anthropic, no una certificación independiente. [1]
Los safeguards estaban activos y afectaron algunos scores. OSWorld 2.0 usa el release de tareas de agosto de 2026 y no es directamente comparable con versiones anteriores. [1]
Terminal-Bench-Science 0.1: 52,6%
Anthropic reporta 52,6% para Fable 5.1 vs 24,7% Fable 5, 29,0% Opus 5 y 22,4% GPT-5.6 Sol. [1]
El standard error declarado es aproximadamente ±3,5–4,5 puntos por modelo, por lo que diferencias pequeñas no deben exagerarse. [1]
Terminal-Bench 4.0 y Fable vs Mythos
Fable 5.1: 55,8%; Mythos 5.1: 60,9%; Fable 5: 42,0%; Opus 5: 52,3%; GPT-5.6 Sol: 37,3%. [1]
Anthropic vincula la diferencia Mythos/Fable a los safeguards. Mythos no representa el score de la configuración pública de Fable. [1]
GDPval-AA, HLE y AutomationBench
GDPval-AA v2: 1853 Fable 5.1, 1723 Fable 5, 1824 Opus 5, 1711 GPT-5.6 Sol. HLE: 60,9% sin tools y 65,0% con tools. [1]
AutomationBench: 31,4% Fable 5.1 vs 17,1% Fable 5 y 26,9% Opus 5. Es evidencia útil, no sustituto de evals propios. [1]
CursorBench 3.2.0 y OSWorld 2.0
CursorBench: 73,4% Fable 5.1, 70,5% Fable 5, 70,0% Opus 5, 67,2% GPT-5.6 Sol. La mejora es mucho menor que en Terminal-Bench-Science. [1]
OSWorld 2.0: 77,9% partial y 41,7% strict. Anthropic advierte que esta versión de tareas no es directamente comparable con releases antiguas. [1]
Effort como palanca de coste y calidad
Anthropic dice que la ventaja sobre Fable 5 crece con effort alto, pero Low/Medium puede igualar o superar Fable 5 con menor coste. [1][3]
La API beta permite cambiar effort por mensaje sin invalidar prompt cache. [3]
Mejores capacidades: agentes largos, research y artefactos
La documentación enumera seis áreas: long-session agentic coding, documentos/spreadsheets/slides, research/search, vision, long context y computer use. [3]
Las evals empresariales deben medir task completion, retries, tool calls, tokens, tiempo total y coste por tarea exitosa. [3][6]
Investigación científica: separar Fable de Mythos
Los ejemplos científicos más avanzados del lanzamiento suelen usar Mythos 5.1, la variante restringida. [1]
Anthropic reporta binders con afinidad 10× mayor que ciertos mejores diseños de competiciones Adaptyv Bio en tres targets y hit rate cercano a 50% en 12 targets. Son resultados Mythos reportados por Anthropic. [1]
Safeguards: menos false positives, límites todavía activos
Anthropic afirma ~60% menos false positives en cyber. Vulnerability discovery en source code está permitida, mientras exploit development, pentesting y ciertos binary scans siguen restringidos. [1][3]
En biología, las intervenciones en preguntas básicas benignas habrían caído ~85% frente a los safeguards iniciales de Fable 5. [1]
Data retention y Enterprise Frontier Safeguards
Fable 5.1 es por defecto un Covered Model con 30 días de retention y sin ZDR estándar salvo autorización explícita. [3]
EFS pretende mantener datos de seguridad en infraestructura cloud controlada por el cliente. Anthropic anuncia rollout por fases más adelante en otoño; AWS documenta modos específicos del proveedor. [1][8]
Content provenance: watermark y C2PA
El texto generado lleva un watermark estadístico Anthropic en las plataformas compatibles, sin tokens ni caracteres ocultos adicionales según Anthropic. [3]
Archivos de imagen/vídeo compatibles pueden recibir C2PA Content Credentials al recuperarse mediante Files API. [3]
Breaking change: forced tool use no funciona
{
"tool_choice": {"type": "auto"}
}
`tool_choice` con `any` o un tool específico forzado devuelve HTTP 400; `auto` y `none` siguen funcionando. [3][5]
Para JSON válido contra schema, Anthropic recomienda strict tool use con `auto` o structured outputs. [3]
Thinking blocks requieren history append-only
Fable 5.1 puede leer thinking blocks de modelos anteriores, pero los anteriores no pueden leer los suyos. [3]
Editar system, tools o mensajes anteriores puede invalidar thinking blocks posteriores. Anthropic recomienda history append-only y cambios mid-conversation. [3][5]
Nuevas funciones API para agentes largos
Beta: per-message effort, turn-scoped system messages y progress updates con `thinking.display: "updates"`. [3]
Fable 5.1 produce menos narración entre tool calls que Fable 5, por lo que las UIs que la necesitan deben configurarla expresamente. [3][6]
Diferencias de comportamiento y prompting
Parallel tool calling es más variable y puede generar más turns. En `low` effort el modelo usa menos search/retrieval. [3][6]
Anthropic también señala prosa más densa, menos formato y más citas no marcadas en algunos resúmenes. [3][6]
Migración desde Fable 5
Además de cambiar `claude-fable-5` por `claude-fable-5-1`, elimina forced tool choice, preserva thinking blocks, usa history append-only y recalibra effort. [5]
Claude Code incluye `/claude-api migrate this project to claude-fable-5-1`, pero no sustituye regression tests propios. [5]
- Actualizar model ID
- Eliminar forced tool use
- No reescribir history con thinking blocks
- Probar routers y fallbacks
- Recalibrar effort
- Medir tool calls y latency
- Recalcular cache cost
- Ejecutar evals propios
Fable 5.1 vs Opus 5 vs Sonnet 5
| Modelo | Contexto | Max output | Input | Output | Latencia |
|---|---|---|---|---|---|
| Fable 5.1 | 1M | 128K | $10 | $50 | Slower |
| Opus 5 | 1M | 128K | $5 | $25 | Moderate |
| Sonnet 5 | 1M | 128K | $2 | $10 | Fast |
Anthropic recomienda empezar la mayoría de workloads con Opus 5. Fable 5.1 está pensado para reasoning exigente y long-horizon agentic work cuando Opus 5 no supera tus evals. [2][3]
Opus 5 cuesta $5/$25 por MTok y Sonnet 5 $2/$10, frente a $10/$50 de Fable 5.1. Los tres tienen 1M context y 128K max output. [2][4]
Disponibilidad y lifecycle
Fable 5.1 está en Claude Platform y principales clouds partner; Anthropic también lo lista para Pro, Max, Team y Enterprise. [2][7]
Status Active (latest), release 1 de septiembre de 2026, retirement no antes del 1 de septiembre de 2027. Pricing/retention regional puede variar por provider. [2][8][10]
Qué cambió realmente
Fable 5.1 combina cache más barato, mejores resultados agentic/research, breaking changes de API y reglas más estrictas de integridad de thinking history. [1][3][4]
No demuestra que sea el mejor en todo. Anthropic sigue recomendando Opus 5 como punto de partida para la mayoría de workloads. [2][3]

