Qwen3.8-Max ma mieć 2,4 bln wszystkich parametrów i korzystać z rzadkiej architektury Mixture-of-Experts (MoE) . W takim rozwiązaniu przy obsłudze konkretnego tokenu uruchamiana jest tylko część całej sieci. Alibaba nie ujawniła jednak, ile parametrów jest aktywowanych w każdym kroku — to kluczowa informacja dla oceny kosztu obliczeń, szybkości działania i wymagań sprzętowych.
To pierwszy multimodalny model Qwen, który przekroczył próg 1 bln parametrów .
Model ma natywnie przetwarzać tekst, obrazy, wideo i dokumenty w ramach jednego systemu, zamiast korzystać z oddzielnego wariantu do obsługi obrazu . Według dostępnych informacji odziedziczył po Qwen3.7-Max kontekst o długości 1 mln tokenów . Niezależny przegląd zaznacza jednak, że ta specyfikacja nie została jednoznacznie potwierdzona w oficjalnej dokumentacji wydania .
Alibaba twierdzi, że Qwen3.8-Max przewyższa poprzednika w programowaniu, tworzeniu aplikacji full-stack, analizie danych, pracy agentowej oraz długotrwałych zadaniach określanych jako „professional cowork” .
Alibaba stwierdziła, że model zajmuje drugie miejsce za Claude Fable 5 wśród systemów, które firma sama porównywała . To jednak nie jest niezależny ranking.
Wraz z zapowiedzią nie opublikowano:
Jeden z niezależnych przeglądów wskazuje, że choć endpoint odpowiada, liczby krążące w sieci jako wyniki Qwen3.8 pochodzą w rzeczywistości z testów Qwen3.7-Max . Dlatego zarówno liczba parametrów, jak i deklarowane drugie miejsce za Fable 5 powinny być obecnie traktowane jako twierdzenia producenta, a nie niezależnie potwierdzone fakty .
Alibaba zapowiedziała, że model zostanie udostępniony z otwartymi wagami . Taki model można później pobrać i uruchamiać lub dostosowywać we własnej infrastrukturze, zależnie od warunków licencji.
Pod koniec lipca 2026 r. nie było jednak:
Jeśli obietnica zostanie spełniona, Qwen3.8-Max może stać się największym publicznie dostępnym modelem z otwartymi wagami. Na razie pozostaje to jednak planem, a nie dostępem do gotowego modelu.
Wersja preview jest dostępna przez trzy kanały :
Standardowa taryfa API rozliczana za milion tokenów wejściowych i wyjściowych nie została opublikowana . Endpointy są zgodne zarówno z protokołem OpenAI, jak i Anthropic, więc deweloperzy mogą podłączyć model do istniejących narzędzi, takich jak Claude Code, Cursor czy OpenCode, bez przebudowy całego środowiska .
Qwen3.8-Max pojawił się zaledwie kilka dni po udostępnieniu przez Moonshot AI modelu Kimi K3 z otwartymi wagami . To kolejny sygnał, że konkurencja na chińskim rynku AI wyraźnie przyspiesza.
W 2026 r. nowe modele flagowe i zapowiedzi otwierania wag publikują zarówno najwięksi gracze technologiczni — Alibaba, Baidu i Tencent — jak i finansowane przez inwestorów firmy takie jak Moonshot, Zhipu AI, 01.AI i DeepSeek . Rywalizacja dotyczy nie tylko jakości, lecz także skali, kosztów dostępu i tego, jak szybko model można udostępnić społeczności.
Decyzja Alibaby, by najpierw ogłosić model o skali 2,4 bln parametrów, a dopiero później dostarczyć niezależnie sprawdzalne dane, wpisuje się w szerszy trend. Chińskie laboratoria próbują zdobyć przewagę wizerunkową za pomocą ogromnych liczb i obietnic otwartych wag, zanim społeczność zdąży zweryfikować ich rzeczywistą skuteczność .
Qwen3.8-Max-Preview jest działającym endpointem API, który można testować, a jego deklarowane parametry są imponujące: 2,4 bln wszystkich parametrów, natywna multimodalność i — według dostępnych opisów — milion tokenów kontekstu. Nie wiadomo jednak jeszcze, jak model wypada w niezależnych testach.
Dla deweloperów preview oznacza możliwość wczesnego eksperymentowania z nowym systemem. Dla całej branży kluczowe będą dopiero publikacja benchmarków, karty modelu i faktyczne udostępnienie wag. Do tego czasu zarówno liczba 2,4 bln parametrów, jak i deklarowane „drugie miejsce za Fable 5” pozostają samooceną Alibaby, a nie niezależnie potwierdzonym wynikiem .