La IA mejoró su propio alineamiento: 4 dólares la hora frente a 150 de un investigador
Las diez pruebas de alineamiento mejoraron sin degradar el rendimiento general. El artículo no rehúye la comparación con los investigadores humanos.
Las diez pruebas de alineamiento mejoraron sin degradar el rendimiento general. El artículo no rehúye la comparación con los investigadores humanos.
El modelo no aprende de verdad, pero se escribe mejores instrucciones tras cada ronda. Gemini 3.5 Flash pasó del 49,5 al 68,1 por ciento de media.
Un minuto de vídeo cuesta 90 dólares, una décima parte de rodar con personas. A algunos intérpretes les exigen ceder voz y rostro antes de despedirlos.
Los productores han aprendido las marcas que deja un modelo: siseo, capas que se traban a la vez. Pero probarlo es difícil y acusar es fácil.
De generador de hipótesis a socio que planifica experimentos, opera un horno y redacta artículos. Pero los médicos no confirmaron sus notas en las pruebas.
Se activó la cláusula de cambio de propiedad. Anthropic se presentó de inmediato como el socio leal, pese a su propio historial.
La demanda apunta a cómo se obtuvieron los datos, no solo a su uso. La empresa ya pagó 1.500 millones por el mismo punto débil.
Un artículo en JAMA sostiene que mantener humanos en el circuito degrada el rendimiento. Incluso sus críticos conceden algo. Así es el debate, paso a paso.
Doce millones de obras copiadas por menos de 10 dólares. Después, quien lo hizo se arrepintió y empezó a construir una herramienta de defensa.
Se cierra el truco de la pegatina sobre el LED. Alemania estudia prohibirlas y una demanda en EE. UU. alega que en Kenia revisan los vídeos.
Que las preguntas de las pruebas acaben en los datos de entrenamiento vacía de sentido los resultados. DeepMind usa criptografía para cerrar ambos lados.
El código hallado por WIRED muestra a Codex generando sus propias tareas y contactando al usuario sin que se lo pidan. La empresa lo confirmó sin dar fecha.