Qwen3.8-27B est un modèle natif vision-langage bâti sur la base Qwen3.5 et utilisant un mécanisme d'attention Hybrid Gated DeltaNet : trois couches d'attention sur quatre emploient une attention linéaire O(n), ce qui permet de gérer des contextes longs sans explosion quadratique de la mémoire . Voici les spécifications issues de la fiche officielle Hugging Face :
| Attribut | Détail |
|---|---|
| Paramètres | ~27B (certaines sources mentionnent 28B) |
| Architecture | Transformer dense avec Hybrid Gated DeltaNet + Gated Attention |
| Fenêtre de contexte | 262 144 jetons nativement, extensible à ~1M via YaRN |
| Modalité | Texte, image et vidéo en entrée ; mode de réflexion activable |
| Licence | Apache 2.0 (poids entièrement ouverts) |
| Taille quantifiée | ~17 Go (4 bits, fonctionne sur des GPU grand public) |
La date de publication a levé plusieurs incertitudes : le modèle inclut un encodeur visuel surprise — la multimodalité n'était pas promise au départ — et la licence Apache 2.0 élimine les frictions juridiques qui freinaient l'adoption des modèles d'IA chinois par les entreprises .
Alibaba a publié un tableau de benchmarks complet sur la fiche Hugging Face du Qwen3.8-27B . Ce tableau compare le modèle 27B open-weight à Meta's Muse Glimmer-30B, au Qwen3.7-Plus (API-only d'Alibaba), à l'Anthropic Opus4.6 Max, et à l'ancienne génération Qwen3.6-27B .
| Benchmark | Qwen3.8-27B | Muse Glimmer-30B | Qwen3.7-Plus | Anthropic Opus4.6 Max | Qwen3.6-27B |
|---|---|---|---|---|---|
| Terminal-Bench 2.1 (codage terminal agentique) | 73,0 | 51,7 | 64,0 | 78,2 | 63,4 |
| SWE-bench Pro (ingénierie logicielle agentique) | 61,7 | — | 57,6 | — | 53,5 |
| CoWorkBench (collaboration bureautique agentique) | 70,7 | — | 65,1 | — | — |
| LiveCodeBench v6 (codage compétitif) | 90,3 | — | 89,6 | 88,8 | 83,9 |
| IFBench (suivi d'instructions) | 79,5 | 77,0 | 79,1 | 62,5 | 69,1 |
Trois résultats marquants :
Par rapport à sa propre génération précédente, le Qwen3.6-27B, le nouveau modèle progresse d'environ 15 % sur Terminal-Bench (73,0 contre 63,4) et gagne 8 points sur SWE-bench Pro . Le 27B affiche également 90,3 sur LiveCodeBench v6, le meilleur score de son groupe de comparaison .
La sortie de Qwen3.8-27B signale un changement de stratégie. La famille Qwen d'Alibaba s'orientait vers la conservation de ses meilleurs modèles derrière des API ; le dernier modèle général open-weight avant celui-ci était le Qwen3.6-27B, daté du 22 avril 2026 . La licence Apache 2.0 sur Qwen3.8-27B, combinée à la possibilité de l'exécuter sur du matériel grand public, marque un retour à la stratégie open-weight qui a bâti la réputation mondiale de Qwen .
Cette décision intervient dans un contexte d'essor spectaculaire des modèles d'IA chinois. À la mi-2026, les modèles d'origine chinoise représentaient environ 61 % du volume de jetons sur OpenRouter, tandis que la part des États-Unis passait d'environ 70 % à 30 % en un an . Une autre estimation montre que les modèles open-weight chinois traitaient 46 % des jetons d'API des entreprises chaque semaine en juillet 2026, contre 35,7 % pour les modèles américains . Gartner prédit que la moitié des entreprises mondiales adopteront des modèles d'IA chinois d'ici deux ans, en raison de leur disponibilité en open-weight, de leurs licences permissives et de leurs prix considérablement plus bas .
Un rapport de mars 2026 de la Commission américano-chinoise sur l'économie et la sécurité a documenté une « boucle de rétroaction » où l'adoption généralisée de l'IA chinoise stimule l'itération, ce qui stimule à son tour l'adoption — y compris par les entreprises américaines . La licence Apache 2.0 de Qwen3.8-27B facilite directement cette tendance en supprimant les frictions juridiques et en permettant à toute organisation d'héberger elle-même un modèle multimodal de pointe sans frais d'API récurrents .