Anthropic publicó Claude Opus 5.5, el primer modelo de la familia Claude 5.5. Según la empresa rinde al nivel de Fable 5.1 en la mayoría del trabajo y cuesta un 40 % menos que Opus 5 con los ajustes por defecto.
OpenAI presentó GPT-6 Sol y Luna. Ambos funcionan a la mitad de precio que sus predecesores y sin un gran salto de capacidad. El argumento de la empresa es la relación precio-rendimiento.
xAI lanzó Grok 4.7, su nuevo modelo insignia para programación y agentes, al mismo precio que Grok 4.6. La tabla de la empresa muestra un gran salto; un índice independiente lo sitúa a media tabla.
GPT-6 Astra destacó en dos pruebas de agentes de Andon Labs: ganó 15.515 dólares en una simulación de expendedoras y fue el primer modelo en superar la referencia humana con drones.
En una aplicación LLM en producción el coste se acumula en dos sitios distintos. Esta guía separa la caché de prefijo de la semántica y dice qué medir.
OpenAI lanzó en beta pública el arnés que ejecuta Codex como Agents API. El agente puede correr en un aislado de OpenAI, en tu infraestructura o en la de un socio.
Google lanzó su tercer modelo Flash en seis semanas. El precio por token es idéntico al de 3.7 Flash, pero el modelo razona más y el coste por tarea sube un 40 por ciento; la propia Google recomienda quedarse en el modelo anterior si prima la eficiencia.
Anthropic presentó sus nuevos modelos con un descuento en la caché. Artificial Analysis, que participó en las pruebas previas, dice que el ahorro no se cumple siempre.
Qwen3.8-Flash-Next tiene 125.000 millones de parámetros pero activa solo 6.000 millones por token. Supera a un modelo con el triple de parámetros activos.
Los modelos se entrenaron desde cero con 15 billones de tokens y permiten activar o desactivar el razonamiento. El modelo de voz transcribe tres horas de audio en un segundo.
El modelo que nadie lograba situar hace unos días resultó ser del laboratorio chino Z.ai, confirmando las primeras conjeturas. Los pesos salen el miércoles.
Ox Alpha se publicó gratis en OpenRouter. El proveedor optó por permanecer anónimo durante la vista previa y las conjeturas oscilan entre China y Microsoft.
MiniMax ha publicado su modelo de texto a música con pesos abiertos. Toma una letra con etiquetas de sección y una descripción musical detallada, y devuelve una canción completa de hasta cinco minutos en una sola generación.
DeepSeek ha publicado Harness, la capa entre un agente y su entorno, bajo licencia MIT. Modelos, herramientas, sesiones y el propio bucle de control quedan tras fronteras de complemento y pueden sustituirse sin tocar el código fuente.
La empresa china Zhipu AI ha publicado GLM-5.3. El modelo comparte base con su predecesor y todas las mejoras proceden solo de un postentrenamiento ampliado. La compañía dice además haber hallado 2.436 vulnerabilidades en 269 proyectos.
NVIDIA anunció soporte desde el primer día en RTX para Qwen3.8-27B, un modelo abierto de 27.000 millones de parámetros. Está dimensionado para una sola GPU y alcanza 131 tokens por segundo en una GeForce RTX 5090.
NVIDIA ha ampliado su modelo de texto a voz multilingüe de pesos abiertos Magpie con árabe estándar moderno, coreano y portugués de Brasil. Su argumento es que ejecutar la generación de voz en la propia infraestructura devuelve el presupuesto de latencia.
OlmoEarth Studio, la plataforma de observación terrestre de Ai2, ha empezado a calcular y exportar vectores numéricos a partir de imágenes de satélite. El código fuente y los pesos son públicos, así que el método puede inspeccionarse.
Liquid AI ha publicado LFM2.5-VL-3B, un modelo de 3.100 millones de parámetros pensado para ejecutarse en el dispositivo. Lee interfaces de pantalla, ubica objetos en coordenadas y, por primera vez en esta línea, llama a herramientas.