Anthropic ha trasladado su modelo más capaz en ciberseguridad a un producto que los equipos de seguridad pueden activar por su cuenta. Desde el 21 de agosto de 2026, los análisis de Claude Security se ejecutan sobre Claude Mythos 5, el modelo de clase Mythos que hasta ahora solo alcanzaba a defensores verificados.

El producto no es una caja de instrucciones

La idea de fondo de este lanzamiento tiene que ver con la interfaz, no con la capacidad. El análisis se conecta a un repositorio de GitHub, sigue los flujos de datos entre archivos y devuelve hallazgos. El usuario no puede preguntar nada al modelo: lo que recibe es un resultado fijo, no una ventana de conversación.

El razonamiento de Anthropic es que el riesgo se concentra allí donde el usuario puede dirigirse directamente al modelo. La capacidad que encuentra una vulnerabilidad es la misma que escribe el código para explotarla. Cuando el modelo trabaja en segundo plano sobre código propio y devuelve una salida definida, no queda vía para pedirle un exploit. La misma lógica se aplica a las integraciones con socios: el usuario final recibe una lista de parches o una alerta generada por Mythos, pero no puede dirigirlo.

Cómo funciona el análisis

En lugar de comparar con patrones de reglas, el modelo sigue el flujo de datos entre archivos y lee el historial del repositorio. Según Anthropic, cada hallazgo pasa después por un paso de verificación adversaria en el que el propio modelo cuestiona su resultado antes de mostrarlo; ese es el mecanismo con el que la compañía dice reducir los falsos positivos.

Los hallazgos se devuelven con:

  • Una categoría CWE: la clasificación estándar de los fallos de software.
  • Niveles de confianza y gravedad: cuán segura es la detección y cuán crítica resulta.
  • Una corrección propuesta: un parche que sigue dependiendo de la aprobación humana.

La clase de fallos que persigue es de gravedad alta: corrupción de memoria, fallos de inyección, elusión de autenticación y errores de lógica entre archivos. Los resultados pueden enviarse a Slack o Jira mediante webhooks, o exportarse en CSV o Markdown. Los análisis pueden acotarse a un directorio y programarse. El parcheo ocurre por separado y se apoya en los modelos que la organización ya tenga; el acceso a Mythos no se extiende a otras superficies.

Quién puede usarlo

La función está en beta pública para clientes de Claude Enterprise. No se adquiere un complemento de modelo aparte: los análisis con Mythos 5 se facturan como uso estándar de tokens dentro del plan existente. Un administrador lo habilita desde la consola. Los equipos en planes Pro, Max y Team no acceden al análisis con Mythos. Anthropic menciona hospitales, servicios públicos, sistemas financieros y la cadena de suministro de software como el conjunto de defensores al que se dirige.

Dos anuncios más en el mismo comunicado

La compañía puso en marcha además el Defender Advantage Fund, que ofrece 35 millones de dólares en créditos de Claude a organizaciones que aseguran software de código abierto. También anunció que ampliará su Programa de Verificación Cibernética en las próximas semanas para cubrir capacidades de doble uso más amplias en Opus y Sonnet, con el acceso de clase Mythos por detrás.

El equilibrio es explícito. Los modelos de clase Mythos se sitúan por encima del nivel Opus y se retuvieron por un motivo: Anthropic afirma que Mythos 5 posee las mayores capacidades en ciberseguridad de cualquier modelo del mundo. Este lanzamiento intenta entregar esa capacidad a los defensores sin ofrecer a los atacantes una opción nueva.