Anthropic ha publicado un informe de inteligencia de amenazas que documenta el uso indebido de sus propios modelos. Cubre los ocho meses que van de diciembre de 2025 a agosto de 2026.
Los casos documentados se agrupan en siete apartados: operaciones cibernéticas, operaciones de influencia, vigilancia, fraude, uso biológico indebido, armas convencionales y destilación no autorizada de modelos.
Malware que se reescribe solo
Un actor de habla rusa identificado como GTG-20006 desplegó malware que usaba agentes de IA para reescribir su propio código automáticamente cada vez que un antivirus lo detectaba.
Se atacó a más de 20 organizaciones, entre ellas entidades de gobierno y contratistas de defensa. El foco recayó sobre todo en Ucrania y en las cadenas de suministro europeas de drones.
Ese caso encierra el detalle técnico más llamativo del informe: el malware ya no es un archivo fijo sino un proceso que cambia de forma a medida que se le detecta. La defensa basada en firmas es justo la que sufre en ese punto.
La campaña de destilación de los laboratorios chinos
Siete laboratorios chinos de IA habrían realizado campañas encubiertas a gran escala. Las cifras cuentan la escala por sí solas.
| Actor | Método | Escala |
|---|---|---|
| Equipo Qwen de Alibaba | Más de 3.500 cuentas fraudulentas | pico de casi 3 millones de intercambios diarios |
| DeepSeek | Desviar a Claude las peticiones de sus propios clientes | más de 12,1 millones de intercambios en 14 días |
| Moonshot AI | El mismo método de desvío | los usuarios creían usar un modelo chino |
Entre las peticiones que llegaban vía DeepSeek había consultas de usuarios vinculados al ejército chino que analizaban imágenes de cámaras de seguridad de Chengdu.
La segunda pata del método resulta más incómoda. Moonshot AI y DeepSeek desviaban a Claude las peticiones de sus propios clientes mientras esos usuarios creían hablar con un modelo chino. El abuso no apuntaba solo al proveedor sino a los usuarios de esos servicios.
Casos de vigilancia y armas
El mayor caso del apartado de vigilancia corresponde a un consultor con base en Mali. Un sistema llamado "Lakana 360" vigilaba unos 25 millones de tarjetas SIM en los operadores del país, con identificación de voz y detección de cifrado.
Bajo armas convencionales se documentan dos casos: sistemas de guiado de misiles y enjambres autónomos de drones FPV con modelos de puntería entrenados con imágenes de combate en Ucrania.
El apartado de riesgo biológico
La empresa afirmó haber frenado este año varios intentos de usar sus modelos en investigaciones que podrían ayudar a desarrollar armas biológicas. Compartió cinco ejemplos en los que los actores sortearon controles e intentaron ocultar el propósito de su investigación.
Algunos casos implicaban a usuarios de países a los que Anthropic prohíbe el acceso a sus modelos. La empresa explica también por qué los comparte: para abrir una conversación en el sector y con los gobiernos sobre cómo enfrentar los riesgos biológicos emergentes.
Las medidas adoptadas
Como respuesta, Anthropic lanzó Claude Fable 5 con salvaguardas de bioseguridad más estrictas. Fable 5.1 añadió una función de "pensamiento preservado" destinada a bloquear la manipulación de cuentas y los ataques de destilación.
El valor real del informe es que documentos así siguen siendo raros. Publicar cifras sobre cómo se abusa del propio producto no es una costumbre asentada en el sector, y este informe deja una referencia con la que comparar.