| Variant | Totaal Aantal Parameters | Actieve Parameters | Contextvenster | Max. Output |
|---|---|---|---|---|
| V4-Pro | 1,6 biljoen (MoE) | ~49B per token | 1M tokens | 384K tokens |
| V4-Flash | 284 miljard (MoE) | ~13B per token | 1M tokens | 384K tokens |
Beide varianten zijn multimodaal (tekst, beeld, video), ondersteunen JSON-output en tool-aanroepen, en zijn beschikbaar via API en web .
| Variant | Input (daluren) | Output (daluren) | Cache-hit |
|---|---|---|---|
| V4-Pro | $0,435 | $0,87 | 90% korting |
| V4-Flash | $0,14 | $0,28 | 90% korting |
DeepSeek hanteerde begin mei 2026 ook nog een promotionele 75%-korting op V4-Pro . Ter vergelijking: de outputprijs van GPT-5.5 ligt rond de $30/MTok, wat V4-Flash ongeveer 107× goedkoper maakt qua output .
De benchmarkresultaten van DeepSeek V4 vertellen een genuanceerd verhaal:
Belangrijke kanttekening van de NIST CAISI-evaluatie (mei 2026): DeepSeeks zelfgerapporteerde benchmarks claimen gelijkwaardigheid met GPT-5.4 en Opus 4.6, maar CAISI's onafhankelijke evaluatie wees uit dat V4 "aanzienlijk minder capabel" is op niet-openbare benchmarks, wat suggereert dat sommige zelfgerapporteerde scores mogelijk opgeblazen zijn . Artificial Analysis' Intelligentie-Index beoordeelt GPT-5.5 (hoog) op 53 versus DeepSeek V4 Pro (Redeneren, Hoge Inspanning) op 41* — GPT-5.5 is intelligenter en sneller (69 vs. 56 tok/s), maar DeepSeek is dramatisch goedkoper ($0,18 vs. $4,35/MTok in redeneermodus) .
Alibaba's Qwen-team gaf een voorproefje van Qwen 3.8 Max tijdens de World AI Conference in Shanghai op 19 juli 2026 . Het is het eerste vlaggenschipmodel van het team met meer dan 1 biljoen parameters.
| Kenmerk | Detail |
|---|---|
| Totaal aantal parameters | 2,4 biljoen (sparse MoE) |
| Architectuur | Mixture-of-Experts, multimodaal (tekst + beeld bevestigd) |
| Contextvenster | 983.616 tokens per Qwen Cloud-eindpunt ; in sommige bronnen herhaald als ~1M |
| Max. output | 64.000 tokens |
| Licentie | Nog niet gepubliceerd; Alibaba zegt open gewichten "binnenkort" |
Er zijn nog geen betalen-per-gebruik-prijzen gepubliceerd. Toegang is momenteel via abonnement via Qwen Chat en geselecteerde API-partners. BenchLM vermeldt Qwen 3.8 Max Preview-prijzen als "Niet vermeld" . Sommige externe trackers tonen automatische prijzen van $1,50/$5,00 per miljoen input-/outputtokens, maar dit is niet door Alibaba bevestigd .
Alibaba stelt dat Qwen 3.8 "alleen onderdoet voor Fable 5" (Anthropic's topmodel Claude), wat het in Alibaba's eigen ranglijst vóór GPT-5.5 en DeepSeek V4 zou plaatsen . Er worden winsten gemeld op het gebied van programmeren, professionele productiviteit, full-stack ontwikkeling, data-analyse en kantoorworkflows ten opzichte van Qwen 3.7 Max .
Er zijn echter geen onafhankelijke benchmarks gepubliceerd. BenchLM, een website die benchmarks bijhoudt, volgt 321 benchmarks voor Qwen 3.8 Max Preview met 0 geverifieerde resultaten per 20 juli 2026 . Zoals een analyse het stelde: "Qwen 3.8 is het testen waard, maar het is te vroeg om het te behandelen als een stabiele productievervanger voor Kimi K3, GPT-5.6 Sol of Claude Fable 5" .
Ter context: de voorgangers van Qwen legden een sterke basis: Qwen 3.6-Max-Preview (20 april 2026) was een tekst-only model met 35B totale / 3B actieve parameters en 262K context, dat beweerde nummer 1 te zijn op zes programmeer- en agent-benchmarks . Qwen 3.7-Max (mei 2026) breidde uit naar een contextvenster van 1M tokens met mogelijkheden voor redenerende agenten . Maar geen van beide werd algemeen als 'frontier' beschouwd, behalve op het gebied van agentisch programmeren.
Alibaba positioneert Qwen 3.8 expliciet als "alleen onderdoend voor Fable 5" . Als deze claim standhoudt onder onafhankelijke evaluatie, zou dat Qwen 3.8 vóór GPT-5.5 en ver vóór DeepSeek V4 plaatsen. Maar met nul geverifieerde benchmarks blijft dit een marketingclaim, geen vaststaand feit. Anthropic's Fable 5 lijkt volgens Alibaba's eigen formulering de huidige erkende frontlineider te zijn .
DeepSeeks agressieve prijsstelling heeft geleid tot een race naar de bodem wat betreft API-kosten. V4-Flash voor $0,14/M input is radicaal goedkoper dan elk westers frontiermodel. Alibaba heeft nog geen prijs voor Qwen 3.8 vastgesteld, maar Qwen 3.6 was al agressief geprijsd (~$1,25/$7,50 input/output) .
De open-weight MIT-licentie voor DeepSeek V4 maakt self-hosting ook mogelijk, wat de marges voor closed-source aanbieders verder onder druk zet . Zoals een analyse het stelde: het praktische effect is dat "ontwikkelaars nu bijna-frontier-capaciteit (voor programmeertaken) kunnen benutten tegen een fractie van de kosten van GPT-5.5 of Claude."