El equipo de IA de Alibaba, Qwen, ha publicado de forma abierta los pesos del modelo Qwen3.8. El lanzamiento es otra señal de la velocidad a la que avanza la competencia en el terreno de los pesos abiertos.

El modelo central: 27.000 millones de parámetros

En el centro de la familia está Qwen3.8-27B, un modelo denso y multimodal de 27.000 millones de parámetros. Según Qwen, supera al mayor Qwen3.7-Plus en programación y tareas de oficina.

El equipo también asegura haber mejorado las capacidades de agente: dice que el modelo planifica de forma más independiente y completa las tareas con mayor fiabilidad. Esas afirmaciones se apoyan en mediciones propias de la empresa; todavía no hay verificación independiente.

Contexto y modos

En el plano técnico, el modelo ofrece:

  • Una ventana de contexto nativa de 262.000 tokens
  • Escalado hasta un millón de tokens mediante el método YaRN
  • Procesamiento de imagen y vídeo además de texto: diagramas, documentos y vídeos de varias horas
  • Un modo de razonamiento flexible, activado por defecto y conmutable en cada consulta

Poder activar y desactivar el razonamiento por consulta es un detalle práctico: razonar de más en tareas sencillas cuesta latencia y dinero.

Licencia y acceso

Los pesos se distribuyen bajo la licencia Apache 2.0, permisiva para uso comercial y relativamente poco restrictiva, más abierta que las licencias propias que algunos rivales asocian a sus lanzamientos de pesos abiertos.

Qwen también ha publicado los pesos del mucho mayor Qwen3.8-2.4T-A95B, diseñado para operar al nivel Max. Ambos modelos están disponibles en Hugging Face y ModelScope.

Una versión alojada con un millón de tokens de contexto estará disponible próximamente a través de Qwen Cloud, el servicio de IA de Alibaba.

¿Por qué es importante?

Los modelos de pesos abiertos son la única opción realista para los equipos que no pueden depender de API cerradas o que deben mantener los datos en su propia infraestructura. Que un modelo de 27.000 millones de parámetros supere a otro mayor en tareas concretas recuerda de nuevo que el tamaño no lo decide todo, y para quien ejecuta modelos en su propio hardware eso se traduce directamente en coste.

Dos modelos, dos necesidades distintas

Que el lanzamiento venga con dos modelos separados no es casual. El modelo denso de 27.000 millones de parámetros tiene un tamaño que cabe en un solo servidor o en una estación de trabajo potente; ese es el objetivo de los equipos que quieren ejecutar el modelo en su propio hardware. Qwen3.8-2.4T-A95B, diseñado para funcionar en el nivel Max, es una clase completamente distinta: aunque sus pesos sean abiertos, ejecutarlo exige una infraestructura seria.

Pesos abiertos no significa siempre "cualquiera puede ejecutarlo". Que los pesos puedan descargarse da margen para auditar, ajustar y evaluar de forma independiente; pero el coste de poner un modelo en producción sigue estando en el hardware. Precisamente por eso importa que el modelo pequeño supere al grande en determinadas tareas.

En qué medición se apoyan las afirmaciones

La ventaja en programación y tareas de oficina, y las capacidades de agente mejoradas, son por ahora declaraciones de la propia Qwen. Todavía no se han publicado resultados de pruebas independientes. Esa es otra ventaja de los modelos de pesos abiertos: las afirmaciones pueden contrastarse desde fuera en poco tiempo, porque no hace falta el permiso de la empresa para ejecutar el modelo.