| Variant | Totale parametere | Aktive parametere | Kontekstvindu | Maks utdata |
|---|---|---|---|---|
| V4-Pro | 1,6 billioner (MoE) | ~49B per token | 1 million token | 384 000 token |
| V4-Flash | 284 milliarder (MoE) | ~13B per token | 1 million token | 384 000 token |
Begge variantene er multimodale (tekst, bilde, video), støtter JSON-utdata og verktøykall, og er tilgjengelige via API og nett .
| Variant | Inn data (utenom rushtid) | Ut data (utenom rushtid) | Treff i hurtigbuffer |
|---|---|---|---|
| V4-Pro | $0,435 | $0,87 | 90 % rabatt |
| V4-Flash | $0,14 | $0,28 | 90 % rabatt |
DeepSeek kjørte også en kampanje med 75 % rabatt på V4-Pro frem til begynnelsen av mai 2026 . Til sammenligning koster GPT-5.5-utdata omtrent $30 per million token, noe som gjør V4-Flash omtrent 107 ganger billigere på utdata .
DeepSeek V4s testresultater gir et sammensatt bilde:
Viktig forbehold fra NIST CAISI-evalueringen (mai 2026): DeepSeeks egne resultater hevder å være på nivå med GPT-5.4 og Opus 4.6, men CAISIs uavhengige evaluering fant at V4 var 'betydelig mindre kapabel' på ikke-offentlige tester, noe som tyder på at noen selvrapporterte resultater kan være overdrevne . Artificial Analysis' Intelligence Index rangerer GPT-5.5 (høy) med 53 mot DeepSeek V4 Pro (Resonnering, Høy Innsats) med 41* – GPT-5.5 er mer intelligent og raskere (69 mot 56 tok/s), men DeepSeek er dramatisk billigere ($0,18 mot $4,35 per million token i resonneringsmodus) .
Alibabas Qwen-team viste frem Qwen 3.8 Max på World AI Conference i Shanghai 19. juli 2026 . Det er teamets første flaggskipmodell over 1 billion parametere.
| Egenskap | Detalj |
|---|---|
| Totale parametere | 2,4 billioner (sparsom MoE) |
| Arkitektur | Mixture-of-Experts, multimodal (tekst + syn bekreftet) |
| Kontekstvindu | 983 616 token per Qwen Cloud-endepunkt ; gjentatt som ~1 million i noen kilder |
| Maks utdata | 64 000 token |
| Lisens | Ikke publisert ennå; Alibaba sier åpne vekter 'snart' |
Ingen betal-per-bruk-priser er offentliggjort. Tilgang er foreløpig via abonnement gjennom Qwen Chat og utvalgte API-partnere. BenchLM lister Qwen 3.8 Max Preview-priser som 'Ikke oppført' . Noen tredjepartssporere viser automatisk prising på $1,50/$5,00 per million inn-/utdatatoken, men dette er ikke bekreftet av Alibaba .
Alibaba hevder at Qwen 3.8 er 'nest best etter Fable 5' (Anthropics fremste Claude-modell), noe som ifølge Alibabas egen rangering ville plassert den foran GPT-5.5 og DeepSeek V4 . Forbedringer hevdes innen koding, profesjonell produktivitet, fullstack-utvikling, dataanalyse og kontorarbeidsflyter sammenlignet med Qwen 3.7 Max .
Imidlertid har ingen uavhengige tester blitt publisert. BenchLM, et nettsted som sporer tester, følger 321 tester for Qwen 3.8 Max Preview med 0 bekreftede resultater per 20. juli 2026 . Som en analyse uttrykte det: 'Qwen 3.8 er verdt å teste, men det er for tidlig å behandle den som en stabil produksjonserstatning for Kimi K3, GPT-5.6 Sol eller Claude Fable 5' .
For kontekst la Qwens forgjengere et sterkt grunnlag: Qwen 3.6-Max-Preview (20. april 2026) var en tekst-only-modell med 35 milliarder totale / 3 milliarder aktive parametere og 262 000 token kontekst, som hevdet å være #1 på seks kode- og agenttester . Qwen 3.7-Max (mai 2026) utvidet seg til et kontekstvindu på 1 million token med resonnerende agentegenskaper . Men ingen av dem ble generelt ansett som førsteklasses utenfor agentisk koding.
Alibaba posisjonerer eksplisitt Qwen 3.8 som 'nest best etter Fable 5' . Hvis denne påstanden holder under uavhengig evaluering, ville den plassert Qwen 3.8 foran GPT-5.5 og langt foran DeepSeek V4. Men med null verifiserte tester forblir dette en markedsføringspåstand, ikke et etablert faktum. Anthropics Fable 5 ser ut til å være den nåværende anerkjente frontlinjelederen ifølge Alibabas egen fremstilling .
DeepSeek's aggressive prising har ført til et kappløp mot bunnen når det gjelder API-kostnader. V4-Flash til $0,14 per million token for inn data er radikalt billigere enn noen vestlig frontlinjemodell. Alibaba har ennå ikke satt prisen på Qwen 3.8, men Qwen 3.6 var allerede aggressivt priset (~$1,25/$7,50 for inn-/utdata) .
Den åpne MIT-lisensen for DeepSeek V4 betyr at selv-hosting også er mulig, noe som ytterligere presser marginene for lukkede kode-leverandører . Som en analyse uttrykte det, er den praktiske effekten at 'utviklere nå kan få tilgang til nesten frontlinjekapasitet (innen koding) til en brøkdel av prisen for GPT-5.5 eller Claude.'