Anthropic lanzó Claude Fable 5.1 y Claude Mythos 5.1 la noche del 1 de septiembre. Técnicamente son el mismo modelo base; la única diferencia es la capa de protección aplicada. Fable 5.1 está disponible de forma general y se invoca desde la API de Claude, Amazon Bedrock, Google Cloud y Microsoft Foundry. Mythos 5.1 solo llega a organizaciones estadounidenses aprobadas dentro de Project Glasswing.
El anuncio se apoya en dos patas: el salto en las pruebas y el precio. Anthropic bajó la lectura de caché de 1,00 a 0,25 dólares por millón de tokens, un recorte del 75 %. La empresa calcula que eso supone un 25 % menos de coste en cargas habituales y hasta un 45 % en tareas de agente prolongadas. Las tarifas base no cambian: 10 y 50 dólares por millón de tokens. Opus 5, en comparación, cuesta la mitad: 5 y 25 dólares.
La objeción vino del propio socio de pruebas
Artificial Analysis, que participó en las pruebas previas al lanzamiento, discute la cifra del 45 %. Según su medición, el descuento ahorra unos 1,40 dólares por tarea en cargas de agente. Pero con el esfuerzo al máximo, Fable 5.1 genera cerca de 1,7 veces más tokens de salida que Fable 5. El resultado es que el coste por tarea no baja: sube un 20 %.
Las cifras: al máximo esfuerzo, Fable 5.1 cuesta 3,76 dólares por tarea del Intelligence Index. Opus 5 cuesta 2,34 dólares en la misma prueba y queda solo tres puntos por debajo. Con esfuerzo extra alto, Fable 5.1 logra 65 puntos por 2,72 dólares: acorta la distancia, pero sigue siendo más caro que Opus 5. El precio elevado se señalaba como la causa principal de la escasa adopción de Fable 5 entre clientes corporativos.
La tabla de resultados
| Prueba | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 (código) | 55.8% | 42.0% | 52.3% | 37.3% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
Como recuerda MarkTechPost, Anthropic informa de un error estándar de entre 3,5 y 4,5 puntos por modelo, así que conviene mirar el margen antes que el orden. Los cinco puntos de diferencia en Terminal-Bench 4.0 entre Fable 5.1 (55,8 %) y Mythos 5.1 (60,9 %) son el coste directo de la capa de protección: mismo modelo, distinto nivel de intervención.
Tres cambios que rompen código
- Desaparece el uso forzado de herramientas. Poner
anyotoolentool_choicedevuelve un error 400. - Los bloques de razonamiento quedan ligados al modelo. Fable 5.1 lee los de modelos anteriores, pero no al revés; los montajes con enrutador y respaldo pierden el razonamiento al degradar.
- Editar turnos anteriores invalida los bloques de razonamiento. La comprobación se aplica a las cuentas creadas a partir del 31 de agosto de 2026.
Anthropic también documenta retrocesos. La llamada paralela a herramientas es más variable, de modo que los bucles de agente pueden hacer una llamada por turno donde Fable 5 agrupaba varias. El modelo narra menos, responde más desde su memoria con esfuerzo bajo y prefiere reescribir el archivo entero antes que hacer ediciones puntuales.
Protecciones y trazabilidad
Las protecciones de ciberseguridad ahora permiten descubrir vulnerabilidades, pero no desarrollar exploits. Anthropic afirma que eso reduce alrededor de un 60 % las intervenciones innecesarias por sesión en Claude Code. En biología, los rechazos indebidos ante peticiones inocuas bajaron un 85 %. Las pruebas de penetración, la generación de exploits y el análisis de binarios siguen redirigiéndose a los modelos Opus. Ambas versiones son además los primeros modelos Claude que incorporan una marca de agua estadística en su texto, con credenciales C2PA en los archivos generados.