Anthropic ha publicado Claude Opus 5.5, el primer modelo de su familia Claude 5.5. Según la empresa, rinde al nivel de Claude Fable 5.1 en la mayoría del trabajo y, con los ajustes por defecto y cargas típicas, cuesta un 40 % menos que Opus 5.
El calendario llama la atención: según TechCrunch, Anthropic publicó el modelo solo 90 minutos antes de que OpenAI anunciara GPT-6 Sol y Luna. Las dos empresas hicieron la misma promesa la misma semana: algo más de capacidad por bastante menos dinero.
De dónde sale el ahorro
Anthropic dice que Opus 5.5 necesita menos cómputo que Opus 5 y que el precio lo refleja. La ganancia viene de tres sitios:
- Las lecturas de caché, que suponen la mayor parte del coste en trabajo de agentes y programación, bajan un 60 %.
- El modelo gasta menos tokens por tarea.
- La generación de salida es más de un 30 % más rápida que en Opus 5.
Sumado, eso da el 40 % de reducción de coste en cargas típicas. El modo rápido en Claude Code y en Claude Platform ofrece hasta 2,5 veces más velocidad a 8 dólares de entrada y 40 de salida por millón de tokens. Anthropic también sube los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise por puestos.
Las pruebas: liderazgo, pero no absoluto
En las pruebas de la propia Anthropic, Opus 5.5 lidera en programación con agentes, uso del ordenador y trabajo de conocimiento. Pero la empresa añade dos advertencias propias: GPT-6 Astra sigue liderando en Terminal-Bench-Science y AutomationBench, y los márgenes entre pruebas son cada vez menos fiables como guía. En su propio uso, dice Anthropic, la distancia con Fable 5.1 es menor de lo que sugieren las puntuaciones.
Los resultados ajustados por coste dicen más. Con el esfuerzo medio por defecto, Opus 5.5 logra un 54,6 % en FrontierCode y supera el mejor resultado de GPT-6 Astra (53,3 %) a una quinta parte del coste por tarea. En CursorBench, con esfuerzo medio, obtiene un 52,5 %: once puntos por encima del mejor resultado de GPT-5.6 Sol y a un tercio del coste.
Lo que informan los primeros probadores
Los ejemplos publicados por Anthropic tratan de trabajos largos:
- Un probador completó una migración de 680.000 líneas de código en menos de un día.
- Otro auditó y corrigió una base de 200.000 líneas en menos de tres horas; a Opus 5 le llevó más de 20 horas y 2,5 veces más tokens.
- En un port interno de C a Rust, Opus 5.5 terminó en 9,5 horas frente a las 12 de Fable 5.1, y costó un 51 % menos.
- Deloitte informa de que Opus 5.5 con el menor esfuerzo detectó el 72 % de los errores conocidos de revisión, frente al 56 % de Opus 5 con esfuerzo alto.
Todos estos datos proceden del fabricante y de probadores elegidos por él.
Acceso
El modelo se puede llamar como claude-opus-5-5 en Claude Platform, Amazon Web Services, Google Cloud y Microsoft Azure. Hay opción de retención cero de datos, como en los Opus anteriores. No se publicaron los pesos, así que no puede alojarse por cuenta propia.
Para quien desarrolla, la pregunta de fondo es esta: cuando dos lanzamientos hacen la misma promesa en la misma semana, ninguna tabla del fabricante dice cuál sale más barato en tu trabajo. Eso solo se ve midiéndolo con tu propia carga.