xAI, la empresa de inteligencia artificial de Elon Musk, lanzó Grok 4.7, su nuevo modelo insignia para programación, tareas de agentes y trabajo de conocimiento. En el anuncio recogido por MarkTechPost la empresa figura como SpaceXAI. Lo más llamativo es el precio: 2 dólares por millón de tokens de entrada y 6 dólares por millón de salida, igual que Grok 4.6.

La historia de fondo es la distancia entre dos tablas: las cifras de la propia empresa muestran un gran salto; la medición independiente lo coloca a media tabla.

Qué cambia

xAI enumera cuatro cambios respecto a Grok 4.6:

  • Un modelo base nuevo y más grande; no se reutilizó el de Grok 4.6.
  • Un entrenamiento por refuerzo más largo, centrado en tareas difíciles que llevan horas.
  • Mejor autoverificación y mejor manejo de contextos largos.
  • Soporte nativo del entorno Grok Bot para conversación y trabajo de conocimiento.

Dos tablas, dos veredictos

En la tabla de la empresa, Grok 4.7 supera a Grok 4.6 en todas las filas. El mayor salto está en Terminal-Bench 4.0, del 20,3 % al 38 %. En la prueba de agentes jurídicos de Harvey obtiene un 19,6 % frente al 6,7 % de Claude Fable 5.1 Max. Aun así, ni en su propia tabla lidera en todo: Fable 5.1 Max gana en cuatro de las siete pruebas.

El índice independiente de Artificial Analysis es más frío. Según The Decoder, en el índice que combina diez pruebas Grok 4.7 obtiene 46 puntos; Claude Fable 5.1 y GPT-6 lideran con 53 cada uno.

Terminal-Bench 4.0Resultado
Grok 4.7, medición de xAI38 %
Grok 4.7, independiente26 %
GPT-6 Astra, independiente60 %
Claude Fable 5.1, independiente55 %
DeepSeek V4.1 Flash, independiente27 %

Parte de la diferencia puede deberse a la configuración: xAI publica sus resultados con el máximo nivel de esfuerzo (xHigh) y todas sus cifras son declaradas por el fabricante. Aun así, llama la atención que un modelo chino mucho más barato, DeepSeek V4.1 Flash, supere por poco a Grok 4.7 en la medición independiente.

El argumento del precio

La defensa de xAI es el coste. Según sus cifras, Fable 5.1 Max es 5 veces más caro en entrada y unas 8,3 veces en salida. The Decoder señala que estos precios están más cerca de los modelos chinos que de los modelos punteros occidentales, probablemente por una buena razón.

El modelo está disponible en la API de xAI, en todos los planes de Cursor, en Grok Build y a través de OpenRouter, Vercel y Cloudflare. Grok 4.7 Fast, con el doble de velocidad y el doble de precio, solo funciona en Cursor y Grok Build. Un punto de acceso regional que mantiene la inferencia en Estados Unidos cuesta un 10 % más.

Seguridad

Grok 4.7 estrena un sistema de salvaguardas completamente nuevo. La empresa asegura que lideró la prueba de bioseguridad de LatchBio con un 62,4 %. En su propia prueba HackerBench, dice que el modelo dejó pasar el 3,3 % de las peticiones cibernéticas de doble uso arriesgadas.

Para los desarrolladores el resumen es sencillo: Grok 4.7 es barato y claramente mejor que su predecesor, pero no ha cerrado la distancia con los modelos de cabeza. Antes de elegir, conviene mirar el coste por tarea con la carga de trabajo propia y no la tabla del fabricante.