Qwen3.8-Max es un modelo de 2,4 billones de parámetros (2.4 trillion) que utiliza una arquitectura dispersa de Mezcla de Expertos (MoE, por sus siglas en inglés). De esos 2,4 billones, aproximadamente 95 mil millones de parámetros se activan por cada token procesado . El modelo admite una ventana de contexto de 1 millón de tokens, puede generar hasta 131.000 tokens de salida y procesa de forma nativa entradas de texto, imagen y video
. Alibaba ha declarado que el rendimiento del modelo es 'solo superado por Claude Fable 5', aunque los puntos de referencia independientes aún eran limitados en el momento del lanzamiento
.
La versión de pesos abiertos, publicada en Hugging Face y ModelScope como Qwen/Qwen3.8-2.4T-A95B, omite ciertas características del modelo en la nube, como la entrada de imágenes y un modo de 'no pensamiento' . Con 2,4T de parámetros totales, el checkpoint es un artefacto de centro de datos multinodo que requiere una infraestructura sustancial para ejecutarse
.
La licencia personalizada de Qwen3.8-Max (no es Apache 2.0) introduce una restricción comercial de dos niveles :
Las empresas más pequeñas, los investigadores y los desarrolladores individuales pueden usar los pesos abiertos libremente sin necesidad de una licencia separada . El umbral de 50 millones de dólares es significativamente más alto que el de 20 millones de dólares en ventas anuales utilizado por Moonshot AI en su licencia Kimi K3, que sirvió como modelo para el enfoque de Alibaba
.
El uso interno del modelo —ejecutarlo para las operaciones propias de una empresa sin ofrecerlo como un servicio alojado o producto a terceros— está explícitamente exento del requisito de licencia comercial . La restricción está dirigida a empresas que empaquetan y revenden el modelo como un asistente de IA o servicio de inferencia, no a empresas que lo utilizan detrás de sus propios cortafuegos
.
Alibaba ofrece Qwen3.8-Max a través de su API alojada con las siguientes tarifas por millón de tokens, confirmadas en el lanzamiento de disponibilidad general del 3 de agosto de 2026 :
Precios internacionales (USD):
Precios en China (CNY):
La API es compatible con OpenAI y DashScope, lo que permite a los desarrolladores cambiar de punto final del modelo simplemente modificando la URL base y el ID del modelo .
El modelo Claude Opus 5 de Anthropic tiene un precio de 5 USD por millón de tokens de entrada y 25 USD por millón de tokens de salida a partir de agosto de 2026, un precio que se ha mantenido estable en múltiples versiones de Opus desde Opus 4.5 . El diferencial de precios es notable:
| Tarifa por 1M de tokens | Qwen3.8-Max | Claude Opus 5 | Descuento de Qwen |
|---|---|---|---|
| Entrada | 2,00 USD | 5,00 USD | 60% más barato |
| Salida | 6,00 USD | 25,00 USD | 76% más barato |
La API de Qwen3.8-Max es un 60% más barata en la entrada y un 76% más barata en la salida en comparación con Claude Opus 5. Esta ventaja de precios es central en la estrategia competitiva de Alibaba para atraer a desarrolladores y empresas que buscan un acceso a modelos de frontera a menor costo .
El lanzamiento de Qwen3.8-Max representa una tendencia más amplia de la industria hacia el abandono de los modelos de IA de código abierto verdaderamente gratuitos . Al abrir los pesos por primera vez, pero imponiendo licencias basadas en los ingresos a los grandes usuarios comerciales, Alibaba intenta capturar valor de la capa de implementación, tratando efectivamente sus pesos de modelo como un activo que genera regalías en lugar de un bien público
. La medida sigue el precedente establecido por la licencia Kimi K3 de Moonshot y señala que la era de la IA open-weight sin restricciones por parte de los principales laboratorios chinos podría estar llegando a su fin para las aplicaciones comerciales a gran escala.