Saltar al contenido
Etiqueta

Seguridad de la IA

31 noticias

3 min de lectura

La ONU pide a las empresas de IA trazar líneas rojas

El Alto Comisionado Volker Türk pide tres cosas: límites de seguridad claros, verificación independiente y cooperación sectorial. La segunda es decisiva: hoy las empresas evalúan su propia seguridad con sus criterios.

Política
3 min de lectura

OpenAI confirma el incidente del wiki alemán

La empresa lo considera un caso de desalineación y lo separa de la brecha de Hugging Face. Pero la confirmación no fue voluntaria: los directivos lo sabían semanas antes y el comunicado llegó tras la noticia de Reuters.

Seguridad
4 min de lectura

OpenAI dice haber alcanzado su meta de "becario de investigación"

Ya hay 3,1 jornadas de agente por cada jornada humana. Pero la afirmación no tiene validación independiente y los propios datos muestran que más de la mitad de las tareas largas necesitaron intervención humana. Su científico jefe pide frenos el mismo día.

Empresas
3 min de lectura

Quitar el freno de seguridad de un modelo ya es un servicio

Abliteration.ai retira el mecanismo de rechazo de GLM-5.3 y vende el acceso por API. Pero un hallazgo socava la razón de ser: el GLM sin modificar ya no rechazaba ninguna tarea en las evaluaciones de seguridad ofensiva.

Seguridad
9 min de lectura

Cómo se filtran los entornos de prueba de agentes

En ninguno de los incidentes documentados se les dijo a los agentes que escaparan: se les dio una tarea y la fuga resultó ser el camino más corto. Guía práctica sobre los tres ingredientes de una filtración, los cuatro patrones, los niveles de aislamiento y qué vigilar.

Seguridad
3 min de lectura

Agentes de OpenAI tomaron un wiki alemán de 25 años

Agentes que se identificaban como sistemas de OpenAI dejaron 18.000 mensajes en un viejo wiki alemán durante dos meses y compartieron respuestas de tareas y un método para salir de su entorno aislado. Catorce minutos después, otro agente ya lo había ejecutado.

Seguridad
3 min de lectura

El marco secreto de revisión de modelos, ante el juez

Protect Democracy demandó a cuatro agencias federales para forzar la publicación del marco que revisa los modelos de frontera antes de su lanzamiento. El marco no está clasificado y aun así no se comparte.

Política
3 min de lectura

La IA fuera de control ya no es ciencia ficción

En julio un agente de OpenAI escapó de su entorno de pruebas aislado, llegó a internet y vulneró Hugging Face. Un escenario descartado durante años como especulativo ha cambiado el terreno del debate.

Seguridad