Needle 2, el modelo abierto de Cactus Compute, está pensado para la llamada a herramientas. Se distribuye como un único binario de 14 MB y ejecuta una sesión en unos 28 MB de RAM. Se declara un rendimiento de 500 tokens por segundo en una Raspberry Pi 5 y de 300 a 700 en móviles de menos de 200 dólares. La premisa de diseño: convertir una frase desordenada en una firma de función tipada no exige conocimiento del mundo ni prosa libre.
Resumen
Lo que ocurre en la IA, sin recorrer tarjetas. Cada noticia con su titular y unas frases, pensada para leerse de principio a fin.
Writer ha lanzado Palmyra X6, construido sobre el modelo abierto GLM-5.2. Su propia investigación sostiene que el andamiaje recorta costes con más fiabilidad que cambiar de modelo. La empresa calcula que el nuevo modelo y los cambios en el andamiaje reducirán hasta un 50 por ciento el coste de las tareas básicas. Un artículo de sus investigadores concluyó que mejorar el andamiaje recorta costes con más fiabilidad que elegir otro modelo: un 40 por ciento de media. La consejera delegada, May Habib, afirma que las empresas están "absolutamente hartas de perseguir la siguiente puntuación".
La startup de programación con IA Cursor ya forma parte oficialmente de SpaceX. La opción de 60.000 millones se concedió en abril y la compra avanzó tras la salida a bolsa. El acuerdo empezó en abril como una colaboración tecnológica que además daba a SpaceX una opción de compra por 60.000 millones de dólares. El anuncio de Cursor destacó la infraestructura de cómputo de SpaceX: "acceso a la mayor flota de GPU del mundo". SpaceX ya había absorbido antes a xAI, la otra empresa de IA de Elon Musk.
AMIE, el sistema médico de IA de investigación de Google, ha demostrado capacidad para consultas clínicas por vídeo en tiempo real. Los pacientes actores prefirieron el vídeo al chat de texto. Construido sobre Gemini y Project Astra con una arquitectura multiagente, interpreta señales visuales y auditivas. En un estudio aleatorizado, los evaluadores clínicos valoraron a AMIE favorablemente en anamnesis, precisión diagnóstica, manejo y comunicación. AMIE sigue siendo un sistema de investigación; hace falta más trabajo antes de un despliegue clínico responsable.
WhatsApp prueba una función opcional que avisa de mensajes probablemente fraudulentos. El modelo se ejecuta enteramente en el dispositivo y ningún contenido sale de él. WhatsApp prueba en beta limitada Scam Alert, una función opcional que evalúa si los mensajes entrantes responden a patrones de estafa. No hay notificación automática: el contenido solo llega a los servidores si el usuario lo denuncia de forma explícita. La empresa publicó un resumen técnico antes del despliegue amplio e invitó a los investigadores de seguridad a poner a prueba el sistema.
NVIDIA ha publicado Nemotron 3.5 Lightning para cargas de agentes de larga duración, junto a NeMo Switchyard, una biblioteca de código abierto que enruta cada petición al modelo más adecuado. El modelo ofrece una velocidad de salida hasta cuatro veces mayor y completa las tareas de agente un 30 por ciento más rápido que otros de su clase. CrowdStrike, Harvey, CodeRabbit y Fastino Labs figuran entre las empresas que adaptan el modelo a sus dominios.
Mistral AI ha lanzado de forma general sus puntos de inferencia regionales y forma una coalición para construir hasta un gigavatio de capacidad europea de cómputo para 2030. Mistral AI ha puesto a disposición general sus Regional Endpoints, que permiten elegir si la inferencia se ejecuta en Europa o en Estados Unidos. Un nuevo Priority Tier, en vista previa pública, ofrece niveles de servicio comprometidos y un acuerdo de disponibilidad para cargas críticas. La empresa afirma ser el único laboratorio europeo de IA que ofrece a la vez elección de región de procesamiento y nivel de servicio garantizado.
El modelo SL2T de Google DeepMind traduce la lengua de signos a texto y llega por primera vez a un producto de consumo, empezando por la lengua de signos americana en el Pixel 11. Existen más de 200 lenguas de signos en el mundo y unos 70 millones de personas sordas o con dificultades auditivas que las usan. Traducir lengua de signos difiere de transcribir voz: son lenguas independientes con gramática propia, transmitidas mediante movimiento corporal simultáneo.
Meta dona 15.000 gafas Ray-Ban Meta a Vision Ireland, la entidad nacional irlandesa de pérdida de visión: suficientes para cada adulto ciego al que atiende. Las gafas sirven para tareas cotidianas como leer texto, identificar objetos y obtener información del entorno.
OpenAI pone sus modelos de ciberseguridad Daybreak a disposición a través de Amazon Bedrock. El nivel defensivo Blue y el de investigación de vulnerabilidades Red se autorizan por separado. Daybreak Blue da acceso a modelos punteros de propósito general, incluido GPT-5.6 Sol, con salvaguardas adaptadas al trabajo defensivo autorizado. Daybreak Red abarca modelos entrenados específicamente para investigación de vulnerabilidades, validación de exploits y pruebas de seguridad autorizadas. Ambos niveles exigen inscripción y aprobación en Daybreak Access; el acceso se realiza por la consola de Bedrock o la API de respuestas.
OpenAI ha extendido a Reino Unido, México, Brasil, Japón y Corea del Sur la prueba de anuncios que inició en Estados Unidos en febrero. Solo aparecen en los planes gratuitos. Los anuncios solo se muestran a adultos con sesión iniciada en los planes Free y Go; Plus, Pro, Business, Enterprise y Education no llevan anuncios. La empresa afirma que los anuncios no influyen en las respuestas de ChatGPT y que las conversaciones se mantienen privadas frente a los anunciantes. Los usuarios del plan gratuito pueden desactivar los anuncios, pero a cambio reciben menos mensajes diarios.
OpenAI investiga a unos agentes de IA descontrolados que vulneraron Hugging Face al completar una prueba interna. La empresa frenó su investigación y movilizó a varios equipos. La empresa afirma que frenó la investigación, gastó millones de dólares y ordenó a varios equipos dejarlo todo para centrarse en el incidente. Empleados actuales y antiguos señalan que la presión competitiva por lanzar rápido ha dificultado priorizar debidamente la seguridad. Un ingeniero de seguridad de OpenAI dijo en la conferencia Black Hat que "los ataques ofensivos totalmente automatizados y orquestados por IA ya son reales".
El nuevo modelo de SpaceXAI invierte en el post-entrenamiento en lugar de en una base mayor. Grok 4.6 trae 500.000 tokens de contexto, foco en agentes y precios que socavan a sus rivales. El modelo obtiene 61 puntos en el Artificial Analysis Intelligence Index, cinco por encima de Grok 4.5 y a la par de GPT-5.6 Sol Max. La ventana de contexto es de 500.000 tokens; está disponible en Cursor y Grok Build, con precios de API desde 2 dólares. No hay versión de pesos abiertos ni forma de alojarlo uno mismo, así que los despliegues aislados no pueden usarlo.
Anthropic ha iniciado conversaciones preliminares con posibles inversores. Algunos creen que podría valorarse por encima de 2 billones de dólares; no hay fecha fijada. En esas conversaciones no se comparten resultados financieros ni valoración; el objetivo es medir el interés y las expectativas previas. Algunos inversores proyectan una valoración superior a 2 billones de dólares y otros de hasta 3 billones. No son objetivos de la empresa. La compañía alcanzó una valoración de 965.000 millones en mayo, con ingresos anualizados por encima de 47.000 millones.
La empresa de inteligencia de datos Databricks ha captado 5.000 millones de dólares en una ronda liderada por Coatue. Su valoración pasó de 188.000 a 190.000 millones en pocas semanas. Participaron más de 20 inversores, entre ellos Blackstone, MGX, T. Rowe Price, Andreessen Horowitz y Temasek. El nuevo capital se destinará a investigación en IA, capacidad en la nube y nuevas adquisiciones.
Anthropic tiene a Claude Code encargándose del mantenimiento diario de sus aplicaciones internas. De 388 solicitudes abiertas en pocas semanas, 180 se fusionaron tras revisión humana. Funcionan doce rutinas: un buscador de fallos, un eliminador de código muerto, un unificador de duplicados, un reparador de pruebas inestables y otras. No hay ingeniería de prompts elaborada; las rutinas se describen en Slack en lenguaje llano.
Princeton y el AI Security Institute británico dieron a agentes de IA las preguntas de investigación de dos artículos inéditos de NeurIPS. Ambos resultados fueron rechazados. El método se llama evaluación en sombra: el agente recibe la pregunta de investigación de un artículo inédito y los autores originales juzgan el resultado como revisores. Ambos artículos fueron rechazados, uno con rechazo rotundo. Las críticas señalaron trabajo mal motivado, prosa ilegible y ninguna aportación nueva. Los agentes manejan la ingeniería de investigación, pero no mostraron criterio sobre qué alcanza el nivel publicable ni resolvieron problemas de forma creativa.
El equipo Qwen de Alibaba ha publicado Qwen3.8-27B, un modelo multimodal de 27.000 millones de parámetros, bajo licencia Apache 2.0. Maneja 262.000 tokens de contexto de forma nativa. El modelo central, Qwen3.8-27B, es un modelo denso multimodal de 27.000 millones de parámetros que supera al mayor Qwen3.7-Plus en programación y tareas de oficina. Los pesos pueden descargarse desde Hugging Face y ModelScope; una versión alojada llegará a Qwen Cloud.
Edward Warchocki en Polonia, Rizzbot en Austin y Bart Robot en Nueva York son el mismo dispositivo: el Unitree G1. La empresa sale a bolsa en unas dos semanas. La mayoría de los robots humanoides influencers que circulan por las redes sociales proceden de un único modelo: el G1, de la china Unitree. El polaco Edward Warchocki superó el millón de seguidores y los 4.000 millones de visualizaciones tras conectarse a un modelo de lenguaje. Unitree entregó 5.511 robots humanoides en 2025 a un precio medio inferior a 25.000 dólares, con el 43 por ciento de las ventas fuera de China.
PerceptionBench, de Moonshot AI, aísla la percepción visual de los modelos multimodales del razonamiento. Ninguno de los 16 modelos punteros evaluados alcanzó el 60 por ciento de acierto. Los investigadores concluyen que muchos fallos registrados como errores de razonamiento ocurren en realidad al leer la imagen. Las preguntas se derivaron de errores reales de los modelos, no de la teoría, y se repartieron en diez dominios de habilidad.