Saltar al contenido

Resumen

Lo que ocurre en la IA, sin recorrer tarjetas. Cada noticia con su titular y unas frases, pensada para leerse de principio a fin.

Un modelo de lenguaje procesa muchísimas más palabras que las que oye un niño al dominar su lengua materna. La brecha tiene nombre, pero no explicación. La lingüística sostuvo durante décadas que la lengua no podía aprenderse solo con estadística; los modelos lo refutaron. La competición BabyLM entrena modelos con datos a escala infantil. El aprendizaje por currículo, de lo simple a lo complejo, funcionó peor de lo esperado. Los niños no reciben los datos de forma pasiva: los eligen explorando. Los modelos no.

Ox Alpha se publicó gratis en OpenRouter. El proveedor optó por permanecer anónimo durante la vista previa y las conjeturas oscilan entre China y Microsoft. Se presenta como un modelo de razonamiento para programación, trabajo con agentes y cargas de producción. El director ejecutivo de Stripe, Patrick Collison, calificó el modelo de muy impresionante. Las conjeturas se reparten entre laboratorios chinos y una versión no publicada del MAI de Microsoft.

El CS-4 sigue usando el WSE-3 de 5 nanómetros. La ganancia viene de la frecuencia de reloj, más potencia y mejor refrigeración. El CS-4 sigue usando el chip WSE-3 de 5 nanómetros; la mejora no procede de un silicio nuevo. Un único armario aloja ahora tres obleas en lugar de dos. El sistema alcanza hasta 4.400 tokens por segundo y usuario. Cerebras afirma que eso es hasta 30 veces más rápido que las configuraciones con procesadores de Nvidia. La capacidad de memoria se mantiene en 44 GB por oblea.

AlgorithmWatch probó cuatro modelos punteros. En al menos una de cada cuatro consultas, la postura ideológica de la organización enlazada quedó sin declarar. La prueba abarcó ChatGPT, Gemini, Grok y Claude; tres personajes ficticios preguntaron en tres idiomas. Una organización llamada Profemina apareció en cerca del 17 por ciento de las respuestas. Gemini enlazó cinco veces al mismo grupo en una conversación y luego advirtió sobre esa fuente. En alemán, la entidad recomendada no expide el certificado que la ley exige para abortar legalmente.

Wired habló con cuatro docentes. Las imágenes saltaron de un centro a otro, las direcciones no supieron reaccionar y un profesor ya no volverá al distrito. El alumno que admitió haber creado la imagen recibió una suspensión interna, pero la difusión continuó. Una abogada sostiene que constituye acoso sexual laboral y genera una obligación para el empleador. No existe una pauta vinculante sobre cómo deben responder los centros ni obligación de informar de la sanción.

Según un borrador del Departamento de Estado revisado por Reuters, los países que se sumen a la iniciativa china quedarían fuera de la coalición estadounidense. El Departamento de Estado prepara una carta que insta a los países socios a elegir bando. El borrador advierte de que ser parte de todo es no ser parte de nada. Alrededor de veinticuatro países y la Unión Europea se han sumado a la coalición Pax Silica. Kazajistán es el único país que se sabe que pertenece a ambos marcos. La organización rival china fue puesta en marcha por Xi Jinping en julio.

V4-Flash-Vision-Exp incorpora procesamiento de imagen sin perder rendimiento en texto. En las pruebas de la propia empresa se acerca a Opus 4.8. Con independencia de la resolución original, cada imagen cuesta como mucho 384 tokens. Una sola petición admite hasta 600 imágenes; el límite de borde se reduce a la mitad pasadas 15. El modelo funciona con los puntos de acceso de OpenAI y de Anthropic.

Una investigación de Nvidia sostiene que en las tareas de horizonte largo lo decisivo no es el modelo, sino la capa de software que lo envuelve. Con un arnés a medida, Claude Opus 5 obtuvo la puntuación máxima en la prueba ARC-AGI-3. Sin el arnés, el mismo modelo obtuvo un 30 por ciento, aun así el mejor resultado entre los evaluados. Dos componentes marcaron la diferencia: buena gestión de memoria y una capa supervisora. Los modelos de OpenAI se habían quedado por debajo del 10 por ciento en la misma prueba. Nvidia no lo vende como producto: distribuye las piezas de forma abierta bajo la marca Nemo.

Los análisis de Claude Security funcionan ya sobre Mythos 5. El usuario no puede dar instrucciones al modelo: recibe hallazgos y un parche propuesto. La función está en beta pública para clientes de Claude Enterprise, sin complemento de modelo aparte. Cada hallazgo incluye una categoría CWE, niveles de confianza y gravedad y un parche propuesto. Anthropic lanzó un fondo que ofrece 35 millones de dólares en créditos a quienes aseguran software libre. Cada parche exige revisión y aprobación humanas.

La plataforma añadió el botón después de que un detector marcara el 41 por ciento de sus publicaciones largas como enteramente generadas por IA. El botón de denuncia de LinkedIn, anunciado el 30 de julio, ha recibido más de un millón de clics. La empresa afirma que las vistas de las publicaciones clasificadas así han caído un 40 por ciento. Quien publique verá ahora un aviso indicando que algunos miembros consideran que el texto parece de IA. LinkedIn retiró además la función que mejoraba las publicaciones con inteligencia artificial.

El fabricante de chips ha entrado en el capital de Cloverleaf Infrastructure, que hace de intermediaria entre eléctricas y centros de datos. Según Reuters, el fabricante de chips posee ya una participación minoritaria en la empresa. The Wall Street Journal informa de que la inversión rondará varios cientos de millones de dólares. Cloverleaf se fundó en 2024 y ese mismo año captó 300 millones de dólares. Nvidia anunció además una inversión de 1.500 millones en el proyecto SB Energy de Ohio esa misma semana.

En las pruebas de TechCrunch, un modelo antiguo de Anthropic generó en diez de diez intentos contenido que su política de uso prohíbe expresamente. La técnica es un método de persuasión de varios turnos que se apoya en las concesiones previas del modelo. Opus 4.7 y posteriores resisten, pero los modelos antiguos siguen accesibles mediante la interfaz de programación. Anthropic afirma que ese uso representa menos del 0,1 por ciento de todas las conversaciones. El investigador comunicó el hallazgo por el programa de recompensas y solo recibió respuestas automáticas.

CoreWeave, Nebius, Lambda, Crusoe y Groq, comparadas por precio publicado, potencia contratada y hoja de ruta de hardware. La tarifa H100 publicada más barata es de 3,85 dólares la hora en Nebius; la más cara, 6,16 en CoreWeave. CoreWeave es el único proveedor con calificación Platino en SemiAnalysis ClusterMAX 2.0. Crusoe es el único que incluye silicio de AMD en su tarifa. Groq se centró por completo en la nube de inferencia tras licenciar su tecnología LPU a Nvidia.

Cerca de un centenar de centros de datos se han levantado en esta ciudad de Mongolia Interior. La luz es barata y el invierno frío, pero llueve como en Denver. Desde 2016 se han abierto o iniciado cerca de 100 centros de datos en Ulanqab. La capacidad comprometida suma 12,5 gigavatios y más del 70 por ciento se anunció en el último año. Como referencia, el proyecto Stargate de OpenAI alcanzará 10 gigavatios cuando esté terminado. DeepSeek, ByteDance, Alibaba y Xiaohongshu construyen allí sus propias instalaciones. La ciudad recibe unos 350 milímetros de lluvia al año y la empresa de aguas ha recurrido a cortes nocturnos.

Métodos tomados de la evaluación psicológica muestran que reducir la seguridad de un modelo a una sola cifra resulta engañoso. Un modelo puede subir su puntuación de seguridad rechazando peticiones en bloque, aunque resulte menos útil. Los ocho conjuntos de pruebas no miden una cualidad llamada seguridad, sino tres cosas casi sin relación entre sí. Solo una parte pequeña de las preguntas discrimina; tres pruebas de 25 preguntas dan el mismo resultado. Seleccionar las preguntas de forma adaptativa recorta el coste entre un 97 y un 99 por ciento. Un método estadístico detecta entre el 80 y el 100 por ciento de los modelos instruidos para ser excesivamente cautos.

El Departamento de Justicia examina que dos socios de a16z ocupen asientos en los consejos de compañías ahora rivales, con una norma casi nunca aplicada a fondos. Ben Horowitz ocupa un asiento en el consejo de Databricks y Martin Casado en el de Fivetran; ambas compiten ya. Según TechCrunch, el Departamento de Justicia lleva casi un año investigando esa configuración. La investigación se apoya en una ley de competencia de 112 años, rara vez usada contra fondos de capital riesgo. Las empresas no eran necesariamente rivales directas cuando a16z invirtió por primera vez. La pregunta de fondo es cómo gestionar los asientos cuando las carteras convergen.

El nuevo complemento de Apple Messages permite buscar, resumir y enviar mensajes con aprobación. Para funcionar exige conceder acceso completo al disco. La aprobación para enviar viene activada por defecto y OpenAI desaconseja concederla de forma permanente. Solo está disponible en Mac con procesador Apple Silicon y funciona a través de ChatGPT Work y Codex.

Los vídeos que promocionaban Higgsfield no llevaban etiqueta publicitaria. La empresa admitió después que pagó a los creadores en dinero y créditos. Matti Haapoja y Sam Kolder publicaron vídeos que exhibían la función Seedance 2.5 de Higgsfield. Ninguno de los vídeos estaba etiquetado como publicidad y ninguno de los dos respondió a The Verge. Otros creadores difundieron capturas de las ofertas de colaboración que habían recibido. Marques Brownlee subrayó que la IA generativa se entrena con material humano sin dar crédito.

Tres de cada cuatro estadounidenses se oponen a que se construya un centro de datos cerca de su casa, según Heatmap News. Un año antes la opinión estaba dividida. En agosto de 2025 el reparto era casi parejo: 43 por ciento a favor y 42 por ciento en contra. El rechazo alcanzó la mayoría por primera vez en febrero de 2026. Una encuesta de Gallup de mayo de 2026 corroboró el hallazgo con un 71 por ciento de rechazo. Las tres preocupaciones más citadas son el coste local de la electricidad, el uso de agua y el uso del suelo.

Starcloud alcanza una valoración de 2.300 millones de dólares. Su director dice que la mayor limitación no son los chips, sino reservar capacidad de lanzamiento. Manhattan West Ventures lideró la ronda; Nvidia aportó 25 millones de dólares. La empresa ha pedido a la FCC permiso para operar 88.000 naves espaciales. SpaceX prevé cerrar el programa Falcon 9 en 2028 y su sucesor, Starship, aún no está probado. Los dos primeros satélites de cómputo llegarán a órbita en vuelos compartidos en 2027.