Qwen3.8-Max se basa en una arquitectura MoE dispersa, la primera en un modelo de clase Max de la familia Qwen. De sus 2,4 billones de parámetros totales, solo se activan aproximadamente 95 mil millones por cada token procesado, lo que representa apenas el 4% del total. Esto reduce drásticamente los costos de inferencia en comparación con un modelo denso de escala similar .
El modelo soporta una ventana de contexto de 1 millón de tokens (con un máximo práctico de entrada de ~991K tokens, que se reduce a ~983K con el modo de pensamiento activado) y una salida máxima de 131K tokens .
Por primera vez en un modelo Qwen por encima de 1 billón de parámetros, Qwen3.8-Max ofrece entrada multimodal nativa: puede procesar texto, imágenes y video. La salida es exclusivamente textual .
En los rankings independientes de Arena, Qwen3.8-Max se posiciona:
Se describe como el mejor modelo de texto chino en Arena y el segundo mejor del mundo en rendimiento multimodal/visual . En PaperBench, reporta la puntuación más alta, con un 93,0 . En Terminal-Bench 2.1, obtiene 86,6, superando a Claude Opus 4.8 y Claude Fable 5 (ambos con 84,6), pero quedando por detrás de GPT-5.6 Sol (max) con 88,8 .
La API está disponible inmediatamente a través de QwenCloud y Alibaba Cloud Model Studio con los siguientes precios :
Los límites de velocidad son de 2 millones de tokens por minuto y 15.000 solicitudes por minuto .
Los pesos abiertos de Qwen3.8-Max y del modelo más pequeño Qwen3.8-27B se esperaban para alrededor del 10 de agosto de 2026, lo que lo convierte en el primer lanzamiento de pesos abiertos para un modelo de clase Max de Qwen .
En una noticia publicada por Reuters el 7 de agosto de 2026, se informó que Alibaba planea exigir a los grandes usuarios comerciales de los pesos abiertos de Qwen3.8-Max que negocien un acuerdo de reparto de ingresos . Esta medida sigue la estrategia de licencias establecida por Moonshot AI con su modelo Kimi K3, que busca un reparto de ingresos de hasta el 30% de los revendedores que generen más de 20 millones de dólares en ventas anuales .
Detalles clave basados en el reportaje de Reuters y múltiples fuentes confirmatorias:
Esto marca un cambio significativo con respecto a los lanzamientos anteriores de Qwen, que ofrecían uso comercial completamente sin restricciones . De implementarse según lo informado, Alibaba se convertiría en el segundo gran laboratorio de IA chino en adjuntar condiciones comerciales a los lanzamientos de pesos abiertos en el plazo de un mes .
Simultáneamente con Qwen3.8-Max, Alibaba lanzó QwenWork (nombre en chino: 千问办公), una plataforma integral de agentes de IA para el entorno laboral .
QwenWork está diseñado para tareas como preparación de documentos, desarrollo de aplicaciones, generación multimodal, desarrollo web, automatización del navegador y tareas programadas, todo impulsado por el nuevo modelo insignia .
El 10 de agosto de 2026, Alibaba lanzó la Plataforma Abierta Qianwen, dando acceso a socios del ecosistema y desarrolladores externos para construir aplicaciones personalizadas de agentes de IA integradas en teléfonos inteligentes, PC y gafas de IA . Esta fue la primera vez que Alibaba abrió su plataforma Qianwen, anteriormente interna, a desarrolladores externos .
El primer grupo de socios abarca más de 10 sectores, incluyendo logística, bienes raíces y gestión de patrimonios, con participantes como SF Express, Ziroom y Midea Group .
El lanzamiento de Alibaba en agosto de 2026 es mucho más que la presentación de un nuevo modelo. Es una estrategia coordinada que combina:
El componente de reparto de ingresos es el más trascendental para la industria de la IA: si se adopta de forma generalizada, podría redefinir lo que realmente significa "IA de código abierto" en la práctica, especialmente para implementaciones comerciales a gran escala.