Alibaba ha lanzado Qwen3.8-Flash-Next, un modelo multimodal que busca ofrecer una "eficiencia de costos máxima". Este nuevo modelo presenta una arquitectura que anticipa las características de Qwen4 y cuenta con un total de 125 mil millones de parámetros, activando solo 6 mil millones por token. Entre sus innovaciones, se encuentra una nueva capa de incrustación N-gram que utiliza 51 mil millones de parámetros y permite almacenar grupos de palabras comunes en un "diccionario de frases".
La versión de producción se lanzará como Qwen3.8-Flash a través de QwenCloud, con un costo de $0.16 por millón de tokens de entrada y $0.47 por millón de tokens de salida. Esta nueva versión promete resultados superiores a Qwen3.7-Plus a un costo de entrenamiento de aproximadamente una novena parte. Los benchmarks de Alibaba indican que Flash-Next supera a modelos más grandes como DeepSeek-V4-Flash y Claude Opus 4.6 en la mayoría de las tareas de prueba, destacándose en programación y tareas de oficina.
En pruebas específicas, Flash-Next logró 58.7 en DeepSWE y 62.5 en SWE-bench Pro, superando notablemente a sus competidores. En tareas de productividad, alcanzó 73.9 en CoWorkBench, mientras que DeepSeek-V4-Flash obtuvo solo 45.1. Estos resultados reflejan una clara ventaja en eficiencia y rendimiento en comparación con versiones anteriores y otros modelos del mercado.