Qwen3.8-Max è costruito su un'architettura MoE sparsa, la prima per un modello di classe Max nella famiglia Qwen . Con 2,4 trilioni di parametri totali, solo circa 95 miliardi di parametri vengono attivati per token — appena il 4% del totale — riducendo drasticamente i costi di inferenza rispetto a modelli densi di dimensioni simili .
Il modello supporta una finestra di contesto da 1 milione di token (l'input massimo pratico è di circa 991.000 token, che scende a circa 983.000 con la modalità di ragionamento attivata) e un output massimo di 131.000 token .
Per la prima volta in un modello Qwen sopra 1 trilione di parametri, Qwen3.8-Max offre un input multimodale nativo: testo, immagini e video . L'output è esclusivamente testuale.
Secondo le classifiche indipendenti di Arena, Qwen3.8-Max si posiziona:
È descritto come il miglior modello cinese per testo su Arena e secondo a livello globale per le prestazioni multimodali/visive . Su PaperBench, riporta il punteggio più alto, pari a 93,0 . Su Terminal-Bench 2.1, ottiene un punteggio di 86,6, superando Claude Opus 4.8 e Claude Fable 5 (entrambi a 84,6) ma dietro a GPT-5.6 Sol (max) a 88,8 .
L'API è stata lanciata immediatamente tramite QwenCloud e Alibaba Cloud Model Studio a questi prezzi :
I limiti di velocità sono fissati a 2 milioni di token al minuto e 15.000 richieste al minuto .
I pesi aperti (open-weight) per Qwen3.8-Max e per il più piccolo Qwen3.8-27B erano attesi intorno al 10 agosto 2026 — rendendo questo il primo rilascio open-weight per un modello di classe Max di Qwen .
Secondo una notizia riportata da Reuters il 7 agosto 2026, Alibaba intende richiedere ai grandi utilizzatori commerciali dei pesi aperti di Qwen3.8-Max di negoziare un accordo di compartecipazione agli utili . La mossa segue il modello di licenza introdotto da Kimi K3 di Moonshot AI, che richiede una quota fino al 30% dai rivenditori con vendite annue superiori a 20 milioni di dollari .
Punti chiave (basati sul report di Reuters e su molteplici fonti di conferma):
Questo segna un cambiamento significativo rispetto ai rilasci precedenti di Qwen, che offrivano un uso commerciale completamente senza restrizioni . Se implementato come riportato, farebbe di Alibaba il secondo grande laboratorio AI cinese in un mese ad associare termini commerciali ai rilasci open-weight .
Contemporaneamente a Qwen3.8-Max, Alibaba ha lanciato QwenWork (nome cinese: 千问办公), una piattaforma all-in-one per agenti AI dedicati al lavoro .
QwenWork è progettato per attività come la preparazione di documenti, lo sviluppo di applicazioni, la generazione multimodale, lo sviluppo web, l'automazione del browser e attività programmate, il tutto alimentato dal nuovo modello di punta .
Il 10 agosto 2026, Alibaba ha lanciato la Qianwen Open Platform, dando accesso a partner dell'ecosistema e sviluppatori terzi per creare applicazioni personalizzate con agenti AI integrate su smartphone, PC e occhiali AI . Questa è stata la prima volta che Alibaba ha aperto la sua piattaforma Qianwen, precedentemente interna, a sviluppatori esterni .
Il primo gruppo di partner copre più di 10 settori, tra cui logistica, immobiliare e gestione patrimoniale, con partecipanti come SF Express, Ziroom e Midea Group .
Il lancio di Alibaba dell'agosto 2026 è molto più del semplice rilascio di un modello. È una strategia coordinata che combina:
La componente di compartecipazione agli utili è la più consequenziale per l'industria dell'AI: se adottata su larga scala, potrebbe ridefinire cosa significhi realmente "AI open-source", specialmente per le implementazioni commerciali su larga scala.