Qwen3.8-27B è un modello nativo vision-linguaggio costruito sulla base di Qwen3.5, che utilizza un meccanismo di attenzione Hybrid Gated DeltaNet in cui tre strati di attenzione su quattro utilizzano un'attenzione lineare O(n), consentendo contesti lunghi senza il costo quadratico della memoria . Le specifiche chiave dalla scheda ufficiale del modello su Hugging Face includono :
| Attributo | Dettaglio |
|---|---|
| Parametri | ~27 miliardi (alcune fonti riportano 28 miliardi totali) |
| Architettura | Transformer denso con Hybrid Gated DeltaNet + Gated Attention |
| Finestra di contesto | 262.144 token nativi, estendibile a ~1 milione tramite YaRN |
| Modalità | Input di testo, immagini e video; modalità di pensiero attivabile |
| Licenza | Apache 2.0 (pesi completamente aperti) |
| Dimensione quantizzata | ~17 GB (4 bit, eseguibile su GPU consumer) |
La data di rilascio ha chiarito diversi dubbi pre-lancio. Il modello include un encoder visivo a sorpresa — la multimodalità non era stata promessa prima del lancio — e la licenza Apache 2.0 rimuove l'attrito legale che storicamente ha frenato l'adozione aziendale dei modelli di AI cinesi .
Alibaba ha pubblicato una tabella completa dei benchmark sulla scheda del modello Qwen3.8-27B su Hugging Face . La tabella confronta il modello aperto da 27B con il Muse Glimmer-30B di Meta, il Qwen3.7-Plus (solo API) di Alibaba, l'Opus4.6 Max di Anthropic e la generazione precedente Qwen3.6-27B .
| Benchmark | Qwen3.8-27B | Muse Glimmer-30B | Qwen3.7-Plus | Anthropic Opus4.6 Max | Qwen3.6-27B |
|---|---|---|---|---|---|
| Terminal-Bench 2.1 (codifica agentica nel terminale) | 73.0 | 51.7 | 64.0 | 78.2 | 63.4 |
| SWE-bench Pro (ingegneria del software agentica) | 61.7 | — | 57.6 | — | 53.5 |
| CoWorkBench (collaborazione d'ufficio/agentica) | 70.7 | — | 65.1 | — | — |
| LiveCodeBench v6 (codifica competitiva) | 90.3 | — | 89.6 | 88.8 | 83.9 |
| IFBench (seguimento delle istruzioni) | 79.5 | 77.0 | 79.1 | 62.5 | 69.1 |
Tre risultati salienti:
Rispetto alla generazione precedente, Qwen3.6-27B, il nuovo modello mostra un guadagno di circa il 15% su Terminal-Bench (73.0 vs. 63.4) e un guadagno di 8 punti su SWE-bench Pro . Il 27B ottiene anche un punteggio di 90.3 su LiveCodeBench v6, il più alto nel suo set di confronto .
Il rilascio di Qwen3.8-27B segna un cambiamento strategico. La famiglia Qwen di Alibaba si stava muovendo verso il mantenimento dei suoi migliori modelli dietro le API; l'ultimo modello generale completamente open-weight prima di questo era Qwen3.6-27B del 22 aprile 2026 . La licenza Apache 2.0 su Qwen3.8-27B, combinata con la capacità di funzionare su hardware consumer, segna un ritorno alla strategia open-weight che ha costruito la reputazione globale di Qwen .
Questo è importante perché i modelli di AI cinesi hanno subito un'impennata di adozione drammatica. Entro la metà del 2026, i modelli di origine cinese hanno raggiunto circa il 61% del volume di token su OpenRouter, mentre la quota statunitense è scesa da circa il 70% al 30% in un solo anno . Un'altra stima mostra che i modelli cinesi open-weight elaborano il 46% dei token API aziendali settimanalmente entro luglio 2026, rispetto al 35.7% per i modelli statunitensi . Gartner prevede che la metà di tutte le imprese globali adotterà modelli di AI cinesi entro due anni, spinti dalla disponibilità di modelli open-weight, dalle licenze permissive e dai prezzi drasticamente inferiori .
Un rapporto di marzo 2026 della Commissione economica e di sicurezza USA-Cina ha documentato un "circolo vizioso" in cui l'adozione diffusa dell'AI cinese guida l'iterazione, che a sua volta guida un'ulteriore adozione, anche da parte di aziende statunitensi . La licenza Apache 2.0 su Qwen3.8-27B facilita direttamente questa tendenza, rimuovendo l'attrito legale e consentendo a qualsiasi organizzazione di ospitare autonomamente un modello multimodale di frontiera senza costi API continui .