Claude Fable 5.1: benchmarks, precio y comparación 2026 | POLPROG Ir al contenido

Claude Fable 5.1 ya está disponible: benchmarks, precio, contexto 1M y comparación con Fable 5, Opus 5 y GPT-5.6 Sol

El 1 de septiembre de 2026 Anthropic lanzó oficialmente Claude Fable 5.1 y Claude Mythos 5.1 con acceso restringido. Fable 5.1 mantiene el precio base de Fable 5, reduce un 75% el coste de cache reads, mejora varios benchmarks agentic y de investigación e introduce breaking changes relevantes en la API. Este análisis separa especificaciones confirmadas, resultados reportados por Anthropic, límites metodológicos y consecuencias reales de migración.

IA
Publicado Escrito por Tiempo de lectura 14 min de lectura

El 1 de septiembre de 2026 Anthropic lanzó oficialmente Claude Fable 5.1 y Claude Mythos 5.1 con acceso restringido. Fable 5.1 mantiene el precio base de Fable 5, reduce un 75% el coste de cache reads, mejora varios benchmarks agentic y de investigación e introduce breaking changes relevantes en la API. Este análisis separa especificaciones confirmadas, resultados reportados por Anthropic, límites metodológicos y consecuencias reales de migración.

En esta página
  1. 1Lanzamiento confirmado: 1 de septiembre de 2026
  2. 2Fable 5.1 y Mythos 5.1: mismo modelo, safeguards distintos
  3. 3Especificaciones técnicas
  4. 4Precio: base igual, cache reads 75% más baratos
  5. 5Qué significan realmente los ahorros del 25–45%
  6. 6Benchmarks: fuertes, pero vendor-reported
  7. 7Terminal-Bench-Science 0.1: 52,6%
  8. 8Terminal-Bench 4.0 y Fable vs Mythos
  9. 9GDPval-AA, HLE y AutomationBench
  10. 10CursorBench 3.2.0 y OSWorld 2.0
  11. 11Effort como palanca de coste y calidad
  12. 12Mejores capacidades: agentes largos, research y artefactos
  13. 13Investigación científica: separar Fable de Mythos
  14. 14Safeguards: menos false positives, límites todavía activos
  15. 15Data retention y Enterprise Frontier Safeguards
  16. 16Content provenance: watermark y C2PA
  17. 17Breaking change: forced tool use no funciona
  18. 18Thinking blocks requieren history append-only
  19. 19Nuevas funciones API para agentes largos
  20. 20Diferencias de comportamiento y prompting
  21. 21Migración desde Fable 5
  22. 22Fable 5.1 vs Opus 5 vs Sonnet 5
  23. 23Disponibilidad y lifecycle
  24. 24Qué cambió realmente

Lanzamiento confirmado: 1 de septiembre de 2026

Anthropic lanzó Fable 5.1 y Mythos 5.1 el 1 de septiembre de 2026. La ficha oficial marca Fable 5.1 como Active (latest) y retirement no antes del 1 de septiembre de 2027. [1][2]

Está disponible como `claude-fable-5-1` en Claude API y en Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry. [2][8][10]

  • Claude API: `claude-fable-5-1`
  • Bedrock: `anthropic.claude-fable-5-1`
  • Estado: Active (latest)
  • Release: 1 de septiembre de 2026

Fable 5.1 y Mythos 5.1: mismo modelo, safeguards distintos

Anthropic afirma que ambos usan el mismo underlying model. Fable 5.1 es generally available y Mythos 5.1 solo para organizaciones aprobadas en programas trusted access como Project Glasswing. [1][3][9]

En Terminal-Bench 4.0 Mythos 5.1 obtiene 60,9% y Fable 5.1 55,8%; Anthropic atribuye la diferencia a intervenciones de safeguards. [1]

Especificaciones técnicas

ParámetroFable 5.1
Contexto1M
Max output128K
ThinkingAdaptive, siempre activo
Default API efforthigh
Knowledge cutoffjunio 2026

Fable 5.1 ofrece contexto 1M como default y maximum, hasta 128K output, entrada texto+imagen y salida texto. Knowledge cutoff fiable y training cutoff: junio de 2026. [2][3]

Adaptive thinking siempre está activado. La API usa `high` como default effort; Claude Code también High, mientras Claude.ai y Cowork usan Medium según el lanzamiento. [1][2][3]

Precio: base igual, cache reads 75% más baratos

ModeloInput / MTokCache read / MTokOutput / MTok
Fable 5.1$10$0.25$50
Fable 5$10$1.00$50
Opus 5$5$0.50$25
Sonnet 5$2$0.20$10

Base: $10/MTok input y $50/MTok output. Cache write 5 min: $12.50; 1 h: $20. Cache read: $0.25/MTok frente a $1.00 en Fable 5. [3][4]

Batch API ofrece 50% de descuento en input/output: $5/$25 por MTok. [4]

Qué significan realmente los ahorros del 25–45%

Anthropic estima alrededor de 25% menos coste en workloads típicos y hasta ~45% en workflows muy agentic y cache-heavy. [1]

No es una rebaja general del list price. La estimación usa cuatro semanas de uso real de agosto de 2026 a default effort y depende del porcentaje de cache reads. [1]

  • Base input/output sin cambios
  • Cache read 75% más barato
  • ~25% en workload típico según Anthropic
  • Hasta ~45% en highly agentic según Anthropic

Benchmarks: fuertes, pero vendor-reported

BenchmarkFable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8%42.0%52.3%37.3%
GDPval-AA v21853172318241711
OSWorld 2.0 partial77.9%72.9%75.4%
OSWorld 2.0 strict41.7%36.1%39.6%
HLE no tools60.9%57.8%56.6%
HLE with tools65.0%63.8%63.6%
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

Anthropic compara Fable 5.1 con Fable 5, Opus 5 y GPT-5.6 Sol. Son resultados del setup de lanzamiento de Anthropic, no una certificación independiente. [1]

Los safeguards estaban activos y afectaron algunos scores. OSWorld 2.0 usa el release de tareas de agosto de 2026 y no es directamente comparable con versiones anteriores. [1]

Terminal-Bench-Science 0.1: 52,6%

Anthropic reporta 52,6% para Fable 5.1 vs 24,7% Fable 5, 29,0% Opus 5 y 22,4% GPT-5.6 Sol. [1]

El standard error declarado es aproximadamente ±3,5–4,5 puntos por modelo, por lo que diferencias pequeñas no deben exagerarse. [1]

Terminal-Bench 4.0 y Fable vs Mythos

Fable 5.1: 55,8%; Mythos 5.1: 60,9%; Fable 5: 42,0%; Opus 5: 52,3%; GPT-5.6 Sol: 37,3%. [1]

Anthropic vincula la diferencia Mythos/Fable a los safeguards. Mythos no representa el score de la configuración pública de Fable. [1]

GDPval-AA, HLE y AutomationBench

GDPval-AA v2: 1853 Fable 5.1, 1723 Fable 5, 1824 Opus 5, 1711 GPT-5.6 Sol. HLE: 60,9% sin tools y 65,0% con tools. [1]

AutomationBench: 31,4% Fable 5.1 vs 17,1% Fable 5 y 26,9% Opus 5. Es evidencia útil, no sustituto de evals propios. [1]

CursorBench 3.2.0 y OSWorld 2.0

CursorBench: 73,4% Fable 5.1, 70,5% Fable 5, 70,0% Opus 5, 67,2% GPT-5.6 Sol. La mejora es mucho menor que en Terminal-Bench-Science. [1]

OSWorld 2.0: 77,9% partial y 41,7% strict. Anthropic advierte que esta versión de tareas no es directamente comparable con releases antiguas. [1]

Effort como palanca de coste y calidad

Anthropic dice que la ventaja sobre Fable 5 crece con effort alto, pero Low/Medium puede igualar o superar Fable 5 con menor coste. [1][3]

La API beta permite cambiar effort por mensaje sin invalidar prompt cache. [3]

Mejores capacidades: agentes largos, research y artefactos

La documentación enumera seis áreas: long-session agentic coding, documentos/spreadsheets/slides, research/search, vision, long context y computer use. [3]

Las evals empresariales deben medir task completion, retries, tool calls, tokens, tiempo total y coste por tarea exitosa. [3][6]

Investigación científica: separar Fable de Mythos

Los ejemplos científicos más avanzados del lanzamiento suelen usar Mythos 5.1, la variante restringida. [1]

Anthropic reporta binders con afinidad 10× mayor que ciertos mejores diseños de competiciones Adaptyv Bio en tres targets y hit rate cercano a 50% en 12 targets. Son resultados Mythos reportados por Anthropic. [1]

Safeguards: menos false positives, límites todavía activos

Anthropic afirma ~60% menos false positives en cyber. Vulnerability discovery en source code está permitida, mientras exploit development, pentesting y ciertos binary scans siguen restringidos. [1][3]

En biología, las intervenciones en preguntas básicas benignas habrían caído ~85% frente a los safeguards iniciales de Fable 5. [1]

Data retention y Enterprise Frontier Safeguards

Fable 5.1 es por defecto un Covered Model con 30 días de retention y sin ZDR estándar salvo autorización explícita. [3]

EFS pretende mantener datos de seguridad en infraestructura cloud controlada por el cliente. Anthropic anuncia rollout por fases más adelante en otoño; AWS documenta modos específicos del proveedor. [1][8]

Content provenance: watermark y C2PA

El texto generado lleva un watermark estadístico Anthropic en las plataformas compatibles, sin tokens ni caracteres ocultos adicionales según Anthropic. [3]

Archivos de imagen/vídeo compatibles pueden recibir C2PA Content Credentials al recuperarse mediante Files API. [3]

Breaking change: forced tool use no funciona

{
  "tool_choice": {"type": "auto"}
}

`tool_choice` con `any` o un tool específico forzado devuelve HTTP 400; `auto` y `none` siguen funcionando. [3][5]

Para JSON válido contra schema, Anthropic recomienda strict tool use con `auto` o structured outputs. [3]

Thinking blocks requieren history append-only

Fable 5.1 puede leer thinking blocks de modelos anteriores, pero los anteriores no pueden leer los suyos. [3]

Editar system, tools o mensajes anteriores puede invalidar thinking blocks posteriores. Anthropic recomienda history append-only y cambios mid-conversation. [3][5]

Nuevas funciones API para agentes largos

Beta: per-message effort, turn-scoped system messages y progress updates con `thinking.display: "updates"`. [3]

Fable 5.1 produce menos narración entre tool calls que Fable 5, por lo que las UIs que la necesitan deben configurarla expresamente. [3][6]

Diferencias de comportamiento y prompting

Parallel tool calling es más variable y puede generar más turns. En `low` effort el modelo usa menos search/retrieval. [3][6]

Anthropic también señala prosa más densa, menos formato y más citas no marcadas en algunos resúmenes. [3][6]

Migración desde Fable 5

Además de cambiar `claude-fable-5` por `claude-fable-5-1`, elimina forced tool choice, preserva thinking blocks, usa history append-only y recalibra effort. [5]

Claude Code incluye `/claude-api migrate this project to claude-fable-5-1`, pero no sustituye regression tests propios. [5]

  • Actualizar model ID
  • Eliminar forced tool use
  • No reescribir history con thinking blocks
  • Probar routers y fallbacks
  • Recalibrar effort
  • Medir tool calls y latency
  • Recalcular cache cost
  • Ejecutar evals propios

Fable 5.1 vs Opus 5 vs Sonnet 5

ModeloContextoMax outputInputOutputLatencia
Fable 5.11M128K$10$50Slower
Opus 51M128K$5$25Moderate
Sonnet 51M128K$2$10Fast

Anthropic recomienda empezar la mayoría de workloads con Opus 5. Fable 5.1 está pensado para reasoning exigente y long-horizon agentic work cuando Opus 5 no supera tus evals. [2][3]

Opus 5 cuesta $5/$25 por MTok y Sonnet 5 $2/$10, frente a $10/$50 de Fable 5.1. Los tres tienen 1M context y 128K max output. [2][4]

Disponibilidad y lifecycle

Fable 5.1 está en Claude Platform y principales clouds partner; Anthropic también lo lista para Pro, Max, Team y Enterprise. [2][7]

Status Active (latest), release 1 de septiembre de 2026, retirement no antes del 1 de septiembre de 2027. Pricing/retention regional puede variar por provider. [2][8][10]

Qué cambió realmente

Fable 5.1 combina cache más barato, mejores resultados agentic/research, breaking changes de API y reglas más estrictas de integridad de thinking history. [1][3][4]

No demuestra que sea el mejor en todo. Anthropic sigue recomendando Opus 5 como punto de partida para la mayoría de workloads. [2][3]

Claude Fable 5.1 es un lanzamiento real del 1 de septiembre de 2026. Su valor no está en un único benchmark, sino en combinar mejor trabajo agentic de larga duración, contexto 1M, cache mucho más barato y un modelo operativo más sofisticado. Como input/output normales siguen costando el doble que Opus 5, la decisión debe basarse en evals propios y coste por tarea completada.

AI Claude Fable 5.1 Anthropic Benchmarks Coding AI Agents API

Preguntas frecuentes

¿Claude Fable 5.1 salió realmente hoy?

Sí, el 1 de septiembre de 2026. [1][2]

¿Cuál es el model ID?

claude-fable-5-1. [2][3]

¿Context window?

1M tokens. [2][3]

¿Max output?

128K tokens. [2]

¿Precio?

$10/MTok input, $50/MTok output y $0.25/MTok cache read. [4]

¿Más barato que Fable 5?

Base igual, cache read cuatro veces más barato; Anthropic estima ~25% típico y hasta ~45% agentic. [1][4]

¿Mejor que Opus 5?

En varios benchmarks Anthropic sí, pero no se garantiza para cada task; Opus 5 sigue siendo la recomendación inicial. [1][2]

¿Fable 5.1 y Mythos 5.1 son el mismo modelo?

Sí, mismo underlying model con safeguards y acceso distintos. [1][3]

¿Se puede desactivar adaptive thinking?

No. [3][5]

¿Funciona forced tool use?

No, devuelve error 400. [3]

¿Hay que cambiar prompts?

No todos, pero hay que retestar tool batching, progress, low-effort search y quoting. [6]

¿Tiene watermark?

Sí para texto; algunos media compatibles reciben C2PA. [3]

¿Tiene ZDR?

No por defecto; 30 días de retention salvo autorización explícita o programa enterprise especial. [1][3][8]

¿Benchmarks independientes?

La tabla de lanzamiento es Anthropic-reported. [1]

¿Conviene migrar?

Un POC tiene sentido para agentes long-horizon y cache-heavy, pero deben tratarse breaking changes y volver a ejecutar evals. [3][5]

Fuentes y referencias

  1. Anthropic, Introducing Claude Fable 5.1 and Claude Mythos 5.11234567891011121314151617181920212223242526272829
  2. Claude Platform Docs, Claude Fable 5.1 overview1234567891011121314
  3. Claude Platform Docs, What's new in Claude Fable 5.112345678910111213141516171819202122232425262728293031
  4. Claude Platform Docs, Pricing123456
  5. Claude Platform Docs, Migrating to Claude Fable 5.1 and Claude Mythos 5.1123456
  6. Claude Platform Docs, Prompting Claude Fable 5.112345
  7. Claude Platform Docs, Claude Fable 5 overview
  8. AWS, Introducing Claude Fable 5.1 on AWS1234
  9. Anthropic, Project Glasswing
  10. Google Cloud, Claude Fable 5.112
  11. VentureBeat, Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache readslectura complementaria

¿Te ha resultado útil?

Recibe nuevos artículos por email

Un correo breve por cada nuevo artículo de la base de conocimiento. Sin spam, te das de baja con un clic.

Solo usamos tu email para enviar nuevos artículos. Sin compartir con terceros.

Volver a la base de conocimiento