Anthropic lanzó Claude Fable 5.1 y Claude Mythos 5.1 el 1 de septiembre, y la cifra destacada no es un benchmark. Es 0,25 dólares: el nuevo precio de un token de entrada en caché, frente a 1,00 dólar en la versión anterior de Fable.
Dos nombres, un mismo modelo
Fable 5.1 y Mythos 5.1 son el mismo sistema distribuido bajo regímenes de salvaguardas distintos. Fable 5.1 está disponible de forma general. Mythos 5.1 queda restringido a organizaciones verificadas que trabajan en ciberseguridad y ciencias de la vida, accesible mediante un programa de acceso restringido y no por la API abierta.
Esa separación es poco habitual. La mayoría de los laboratorios publica un modelo y limita capacidades dentro de él. Anthropic limita en cambio quién puede alcanzar la configuración menos restringida, lo que convierte al propio programa de acceso en parte del producto.
El cambio de precio es la noticia
El precio estándar no varía: 10 dólares por millón de tokens de entrada y 50 por millón de salida. El procesamiento por lotes reduce ambos a la mitad, a 5 y 25 dólares.
Lo que se ha movido es la caché. Una lectura en caché cuesta ahora 0,25 dólares por millón de tokens, el 2,5% del precio estándar de entrada, cuando la mayoría de los modelos Claude aplican un 10%. Anthropic cifra el efecto práctico en torno a un 25% menos de coste en cargas de trabajo habituales y hasta un 45% en tareas agénticas con mucho contexto.

Para cualquier proceso que relea un contexto extenso en cada turno —un agente recorriendo un repositorio, una investigación de larga duración, una cadena de procesamiento documental— esa es la diferencia entre un coste que crece con cada turno y otro que casi no lo hace.
Los benchmarks y lo que no resuelven
En Terminal-Bench-Science 0.1, un benchmark de investigación científica agéntica, Anthropic sitúa a Fable 5.1 en el 52,6%, frente al 29,0% de Opus 5, el 24,7% de Fable 5 y el 22,4% de GPT-5.6 Sol. En Terminal-Bench 4.0, Fable 5.1 alcanza el 55,8% y Mythos 5.1 el 60,9%.
La compañía también declara un 73,4% en CursorBench 3.2.0, un 31,4% en AutomationBench, un 41,7% en la división estricta de OSWorld 2.0 y un 77,9% en la parcial, 1.853 puntos en GDPval-AA v2, y Humanity’s Last Exam con un 60,9% sin herramientas y un 65,0% con ellas.
Todas esas cifras proceden de la evaluación que Anthropic hace de su propio modelo. Conviene leerlas como una afirmación sobre la dirección del trabajo, no como un resultado reproducido de forma independiente. La diferencia entre Mythos 5.1 y Fable 5.1 en Terminal-Bench —cinco puntos con pesos idénticos— es la señal más clara de la tabla, porque mide lo que cuesta el régimen de salvaguardas, no lo que sabe el modelo.
Dónde funciona
El modelo responde a claude-fable-5-1 en la API y se distribuye en Claude Code, Claude Enterprise y Claude Platform. En la nube está disponible a través de Amazon Bedrock, Google Agent Platform y Microsoft Foundry.

Anthropic no ha publicado la ventana de contexto de ninguno de los dos modelos.
Qué vigilar
Dos cosas. Primera, si evaluadores independientes reproducen la diferencia en Terminal-Bench-Science: una ventaja de 23 puntos sobre la generación anterior es lo bastante grande como para que importe la confirmación externa. Segunda, si se mantiene un multiplicador de caché del 2,5%. Está muy por debajo del resto de la gama Claude, y reajustar el precio de una caché es más fácil que reajustar el de un modelo.