| Wariant | Parametry ogółem | Parametry aktywne | Okno kontekstowe | Maks. wynik |
|---|---|---|---|---|
| V4-Pro | 1,6 biliona (MoE) | ~49 mld na token | 1 mln tokenów | 384 tys. tokenów |
| V4-Flash | 284 mld (MoE) | ~13 mld na token | 1 mln tokenów | 384 tys. tokenów |
Oba warianty są multimodalne (tekst, obraz, wideo), obsługują wyjście JSON i wywołania narzędzi oraz są dostępne przez API i stronę internetową .
| Wariant | Wejście (poza szczytem) | Wyjście (poza szczytem) | Trafienie w pamięć podręczną |
|---|---|---|---|
| V4-Pro | 0,435 USD | 0,87 USD | 90% zniżki |
| V4-Flash | 0,14 USD | 0,28 USD | 90% zniżki |
DeepSeek prowadził również promocję z 75% zniżką na V4-Pro do początku maja 2026 roku . Dla porównania, cena wyjściowa GPT-5.5 wynosi około 30 USD/MTok, co czyni V4-Flash mniej więcej 107 razy tańszym na wyjściu .
Wyniki testów porównawczych DeepSeek V4 przedstawiają zniuansowany obraz:
Ważne zastrzeżenie z oceny NIST CAISI (maj 2026): Samodzielnie zgłaszane wyniki DeepSeek sugerują parytet z GPT-5.4 i Opus 4.6, ale niezależna ocena CAISI wykazała, że V4 jest „znacznie mniej zdolny” w niepublicznych testach, co sugeruje, że niektóre samodzielnie zgłaszane wyniki mogą być zawyżone . Indeks Inteligencji Artificial Analysis ocenia GPT-5.5 (wysoki) na 53 wobec DeepSeek V4 Pro (Rozumowanie, Wysoki Wysiłek) na 41* — GPT-5.5 jest bardziej inteligentny i szybszy (69 wobec 56 tok/s), ale DeepSeek jest dramatycznie tańszy (0,18 USD wobec 4,35 USD/MTok w trybie rozumowania) .
Zespół Qwen z Alibaby zaprezentował Qwen 3.8 Max na Światowej Konferencji AI w Szanghaju 19 lipca 2026 roku . Jest to pierwszy flagowy model zespołu powyżej 1 biliona parametrów.
| Atrybut | Szczegóły |
|---|---|
| Parametry ogółem | 2,4 biliona (rzadki MoE) |
| Architektura | Mixture-of-Experts, multimodalny (tekst + obraz potwierdzone) |
| Okno kontekstowe | 983 616 tokenów na punkt końcowy Qwen Cloud ; w niektórych źródłach powtarzane jako ~1 mln |
| Maks. wynik | 64 000 tokenów |
| Licencja | Jeszcze nie opublikowana; Alibaba mówi o otwartej wadze „wkrótce” |
Nie opublikowano cen w modelu pay-as-you-go. Dostęp jest obecnie możliwy przez subskrypcję za pośrednictwem Qwen Chat i wybranych partnerów API. BenchLM podaje cenę wersji zapoznawczej Qwen 3.8 Max Preview jako „Nie wymieniona” . Niektóre zewnętrzne trackery pokazują automatyczne ceny na poziomie 1,50/5,00 USD za milion tokenów wejściowych/wyjściowych, ale nie jest to potwierdzone przez Alibabę .
Alibaba twierdzi, że Qwen 3.8 jest „drugi tylko po Fable 5” (najlepszy model Claude od Anthropica), co w rankingu Alibaby plasowałoby go przed GPT-5.5 i DeepSeek V4 . Deklarowane są ulepszenia w zakresie kodowania, produktywności zawodowej, tworzenia pełnego stosu, analizy danych i przepływów pracy biurowej w stosunku do Qwen 3.7 Max .
Jednakże nie opublikowano żadnych niezależnych testów porównawczych. BenchLM, strona śledząca testy, śledzi 321 testów dla Qwen 3.8 Max Preview, z czego 0 zweryfikowanych wyników według stanu na 20 lipca 2026 roku . Jak ujęła to jedna z analiz: „Qwen 3.8 jest wart testowania, ale jest zbyt wcześnie, aby traktować go jako stabilny zamiennik produkcyjny dla Kimi K3, GPT-5.6 Sol czy Claude Fable 5” .
Dla kontekstu, poprzednicy Qwen położyli solidny fundament: Qwen 3.6-Max-Preview (20 kwietnia 2026) był modelem wyłącznie tekstowym z 35 mld parametrów ogółem / 3 mld aktywnych i oknem kontekstowym 262 tys., który twierdził, że jest #1 w sześciu testach kodowania i agentów . Qwen 3.7-Max (maj 2026) rozszerzył okno kontekstowe do 1 mln tokenów, dodając możliwości agenta rozumowania . Ale żaden nie był powszechnie uważany za model na poziomie granicznym poza agentowym kodowaniem.
Alibaba wyraźnie pozycjonuje Qwen 3.8 jako „drugi tylko po Fable 5” . Jeśli to twierdzenie utrzyma się w niezależnej ocenie, plasowałoby Qwen 3.8 przed GPT-5.5 i daleko przed DeepSeek V4. Ale przy zerowej liczbie zweryfikowanych testów pozostaje to twierdzeniem marketingowym, a nie ustalonym faktem. Fable 5 od Anthropica wydaje się być obecnie uznanym liderem na granicy możliwości, zgodnie z własnymi ramami Alibaby .
Agresywna polityka cenowa DeepSeek doprowadziła do wyścigu na dno w zakresie kosztów API. V4-Flash za 0,14 USD/M na wejściu jest radykalnie tańszy niż jakikolwiek zachodni model graniczny. Alibaba nie ustalił jeszcze ceny Qwen 3.8, ale Qwen 3.6 był już agresywnie wyceniony (~1,25/7,50 USD na wejściu/wyjściu) .
Otwarta waga na licencji MIT dla DeepSeek V4 oznacza, że możliwe jest również samodzielne hostowanie, co dodatkowo ściska marże dostawców o zamkniętym kodzie źródłowym . Jak ujęła to jedna z analiz, praktycznym efektem jest to, że „programiści mogą teraz uzyskać dostęp do możliwości bliskich granicy (w zadaniach kodowania) za ułamek kosztów GPT-5.5 lub Claude”.