O Qwen3.8-Max é construído sobre uma arquitetura MoE esparsa, sendo o primeiro modelo Max do Qwen a adotar esse design . Com 2,4 trilhões de parâmetros totais, apenas cerca de 95 bilhões de parâmetros são ativados por token — aproximadamente 4% do total —, o que reduz drasticamente os custos de inferência em comparação com modelos densos de escala similar .
O modelo suporta uma janela de contexto de 1 milhão de tokens (a entrada máxima prática é de ~991 mil tokens, caindo para ~983 mil com o modo de raciocínio ativado) e uma saída máxima de 131 mil tokens .
Pela primeira vez em um modelo Qwen acima de 1 trilhão de parâmetros, o Qwen3.8-Max oferece entrada multimodal nativa: texto, imagens e vídeo . A saída é exclusivamente em texto.
Nos rankings independentes do Arena, o Qwen3.8-Max ocupa:
Ele é descrito como o melhor modelo chinês de texto no Arena e o segundo globalmente em desempenho multimodal/visual . No PaperBench, registra a maior pontuação, com 93,0 . No Terminal-Bench 2.1, alcança 86,6, superando o Claude Opus 4.8 e o Claude Fable 5 (ambos com 84,6), mas ficando atrás do GPT-5.6 Sol (max), que marcou 88,8 .
A API foi lançada imediatamente através do QwenCloud e do Alibaba Cloud Model Studio com os seguintes preços :
Os limites de taxa são de 2 milhões de tokens por minuto e 15 mil solicitações por minuto .
Os pesos abertos do Qwen3.8-Max e do modelo menor Qwen3.8-27B estavam previstos para serem lançados por volta de 10 de agosto de 2026 — tornando-se o primeiro lançamento de pesos abertos para um modelo da classe Max da Qwen .
Em uma reportagem exclusiva da Reuters em 7 de agosto de 2026, a Alibaba planeja exigir que grandes usuários comerciais dos pesos abertos do Qwen3.8-Max negociem um acordo de divisão de receita . A medida segue o manual de licenciamento estabelecido pelo Kimi K3 da Moonshot AI, que busca uma divisão de receita de até 30% de revendedores que geram mais de US$ 20 milhões em vendas anuais .
Detalhes principais (com base na reportagem da Reuters e em múltiplos veículos confirmadores):
Isso marca uma mudança significativa em relação aos lançamentos anteriores do Qwen, que ofereciam uso comercial completamente irrestrito . Se implementado conforme relatado, tornaria a Alibaba o segundo grande laboratório chinês de IA a anexar termos comerciais a lançamentos de pesos abertos em menos de um mês .
Simultaneamente ao Qwen3.8-Max, a Alibaba lançou o QwenWork (nome em chinês: 千问办公), uma plataforma completa de agentes de IA para o ambiente de trabalho .
O QwenWork foi projetado para tarefas como preparação de documentos, desenvolvimento de aplicativos, geração multimodal, desenvolvimento web, automação de navegador e tarefas agendadas — tudo alimentado pelo novo modelo principal .
Em 10 de agosto de 2026, a Alibaba lançou a Plataforma Aberta Qianwen, dando a parceiros do ecossistema e desenvolvedores terceirizados acesso para construir aplicativos personalizados de agentes de IA integrados em smartphones, PCs e óculos de IA . Esta foi a primeira vez que a Alibaba abriu sua plataforma Qianwen, anteriormente interna, para desenvolvedores externos .
O primeiro grupo de parceiros abrange mais de 10 setores, incluindo logística, imobiliário e gestão de patrimônio, com participantes como SF Express, Ziroom e Midea Group .
O lançamento da Alibaba em agosto de 2026 é mais do que um novo modelo. É uma estratégia coordenada que combina:
O componente de divisão de receita é o mais consequente para a indústria de IA: se adotado amplamente, pode redefinir o que "IA open-source" significa na prática — especialmente para implantações comerciais em larga escala.