El nuevo modelo de Alibaba supera a su antecesor con la novena parte del coste de entrenamiento
Qwen3.8-Flash-Next tiene 125.000 millones de parámetros pero activa solo 6.000 millones por token. Supera a un modelo con el triple de parámetros activos.