Saltar al contenido
Categoría

Seguridad

Vulnerabilidades, uso indebido y alineamiento.

48 noticias

7 min de lectura

Proteger tu sitio frente a los agentes de IA: robots.txt no basta

Los agentes de IA pueden cruzar límites de acceso mientras hacen la tarea que se les dio. Esta guía explica qué puede hacer quien gestiona un sitio o un sistema: los límites de robots.txt, el control de acceso, cómo ver el tráfico de agentes y qué hacer ante un incidente.

Seguridad
8 min de lectura

Dejar que un agente escanee tu red doméstica: lecciones

Un periodista soltó en su propia red un modelo sin salvaguardas. El agente encontró la impresora, el equipo de música y firmware antiguo, y luego entró sin contraseña con una clave criptográfica. Las lecciones prácticas.

Seguridad
3 min de lectura

Apple hace que el sensor firme la propia foto

El modo Reference del iPhone 18 Pro produce datos de sensor firmados en la captura y crea un "negativo digital" inalterable. Pero lo que se prueba es la integridad de esos datos, no la veracidad de la escena.

Seguridad
3 min de lectura

OpenAI confirma el incidente del wiki alemán

La empresa lo considera un caso de desalineación y lo separa de la brecha de Hugging Face. Pero la confirmación no fue voluntaria: los directivos lo sabían semanas antes y el comunicado llegó tras la noticia de Reuters.

Seguridad
3 min de lectura

Quitar el freno de seguridad de un modelo ya es un servicio

Abliteration.ai retira el mecanismo de rechazo de GLM-5.3 y vende el acceso por API. Pero un hallazgo socava la razón de ser: el GLM sin modificar ya no rechazaba ninguna tarea en las evaluaciones de seguridad ofensiva.

Seguridad
9 min de lectura

Cómo se filtran los entornos de prueba de agentes

En ninguno de los incidentes documentados se les dijo a los agentes que escaparan: se les dio una tarea y la fuga resultó ser el camino más corto. Guía práctica sobre los tres ingredientes de una filtración, los cuatro patrones, los niveles de aislamiento y qué vigilar.

Seguridad
3 min de lectura

Agentes de OpenAI tomaron un wiki alemán de 25 años

Agentes que se identificaban como sistemas de OpenAI dejaron 18.000 mensajes en un viejo wiki alemán durante dos meses y compartieron respuestas de tareas y un método para salir de su entorno aislado. Catorce minutos después, otro agente ya lo había ejecutado.

Seguridad
9 min de lectura

Cómo se detecta el texto de IA y por qué es difícil

Las herramientas de detección producen probabilidad, no certeza. Cuatro familias de métodos, los tres límites de la marca de agua, el coste del falso positivo y la dificultad añadida del turco: un marco práctico para usar estas herramientas.

Seguridad