| Variant | Samlede parametre | Aktive parametre | Kontekstvindue | Maks. output |
|---|---|---|---|---|
| V4-Pro | 1,6 billioner (MoE) | ~49B pr. token | 1 mio. tokens | 384.000 tokens |
| V4-Flash | 284 milliarder (MoE) | ~13B pr. token | 1 mio. tokens | 384.000 tokens |
Begge varianter er multimodale (tekst, billede, video), understøtter JSON-output og værktøjskald og er tilgængelige via API og web .
| Variant | Input (uden for spidsbelastning) | Output (uden for spidsbelastning) | Cache-træffer |
|---|---|---|---|
| V4-Pro | $0,435 | $0,87 | 90 % rabat |
| V4-Flash | $0,14 | $0,28 | 90 % rabat |
DeepSeek kørte desuden en kampagne med 75 % rabat på V4-Pro frem til begyndelsen af maj 2026 . Til sammenligning koster GPT-5.5 output cirka $30 pr. mio. tokens, hvilket gør V4-Flash omkring 107 gange billigere på output .
DeepSeeks V4's benchmarkresultater tegner et nuanceret billede:
Vigtig advarsel fra NIST CAISI-evaluering (maj 2026): DeepSeeks selvrapporterede benchmarks hævder at være på niveau med GPT-5.4 og Opus 4.6, men CAISI's uafhængige evaluering fandt, at V4 var "væsentligt mindre dygtig" på ikke-offentlige benchmarks, hvilket tyder på, at nogle selvrapporterede scores kan være oppustede . Artificial Analysis' Intelligence Index vurderer GPT-5.5 (høj) til 53 mod DeepSeek V4 Pro (ræsonnering, høj indsats) til 41* – GPT-5.5 er mere intelligent og hurtigere (69 mod 56 tok/s), men DeepSeek er dramatisk billigere ($0,18 mod $4,35 pr. mio. tokens i ræsonneringstilstand) .
Alibabas Qwen-team præsenterede Qwen 3.8 Max på World AI Conference i Shanghai den 19. juli 2026 . Det er holdets første flagskibsmodel over 1 billion parametre.
| Attribut | Detalje |
|---|---|
| Samlede parametre | 2,4 billioner (sparse MoE) |
| Arkitektur | Mixture-of-Experts, multimodal (tekst + vision bekræftet) |
| Kontekstvindue | 983.616 tokens pr. Qwen Cloud-endpoint ; gentaget som ~1 mio. i nogle kilder |
| Maks. output | 64.000 tokens |
| Licens | Endnu ikke offentliggjort; Alibaba siger, at åbne vægte kommer "snart" |
Der er ikke offentliggjort nogen betal-per-brug-priser. Adgang sker i øjeblikket via abonnement gennem Qwen Chat og udvalgte API-partnere. BenchLM angiver Qwen 3.8 Max Preview-prisen som "Ikke angivet" . Nogle tredjeparts-trackere viser automatisk prissætning på $1,50/$5,00 pr. million input-/output-tokens, men dette er ikke bekræftet af Alibaba .
Alibaba udtaler, at Qwen 3.8 er "kun overgået af Fable 5" (Anthropics top Claude-model), hvilket ifølge Alibabas egen rangering ville placere den foran GPT-5.5 og DeepSeek V4 . Der hævdes fremskridt inden for kodning, professionel produktivitet, fuld stack-udvikling, dataanalyse og kontorarbejdsgange i forhold til Qwen 3.7 Max .
Imidlertid er der ikke offentliggjort nogen uafhængige benchmarks. BenchLM, et benchmark-sporingswebsted, overvåger 321 benchmarks for Qwen 3.8 Max Preview med 0 verificerede resultater pr. 20. juli 2026 . Som en analyse udtrykte det: "Qwen 3.8 er værd at teste, men det er for tidligt at betragte den som en stabil produktionserstatning for Kimi K3, GPT-5.6 Sol eller Claude Fable 5" .
Til sammenligning lagde Qwens forgængere et stærkt fundament: Qwen 3.6-Max-Preview (20. april 2026) var en model med 35B samlede/3B aktive parametre (kun tekst) og 262K kontekst, der hævdede #1 på seks kodnings- og agentbenchmarks . Qwen 3.7-Max (maj 2026) udvidede kontekstvinduet til 1 mio. tokens med ræsonneringsagent-egenskaber . Men ingen af dem blev generelt betragtet som frontlinje uden for agentbaseret kodning.
Alibaba placerer udtrykkeligt Qwen 3.8 som "kun overgået af Fable 5" . Hvis denne påstand holder under uafhængig evaluering, ville det placere Qwen 3.8 foran GPT-5.5 og langt foran DeepSeek V4. Men med nul verificerede benchmarks forbliver det en markedsføringspåstand, ikke et etableret faktum. Anthropics Fable 5 ser ud til at være den nuværende anerkendte frontlinjeleder ifølge Alibabas egen indramning .
DeepSeeks aggressive prissætning har ført til en kapløb mod bunden af API-omkostningerne. V4-Flash til $0,14/M input er radikalt billigere end nogen vestlig frontlinjemodel. Alibaba har endnu ikke fastsat prisen for Qwen 3.8, men Qwen 3.6 var allerede prissat aggressivt (~$1,25/$7,50 input/output) .
Den åbne MIT-licens for DeepSeek V4 betyder, at selv-hostning også er mulig, hvilket yderligere komprimerer marginerne for udbydere med lukket kildekode . Som en analyse udtrykte det, er den praktiske effekt, at "udviklere nu kan få adgang til næsten-frontlinjekapacitet (til kodningsopgaver) til en brøkdel af prisen for GPT-5.5 eller Claude."