| Muunnelma | Parametrit yhteensä | Aktiiviset parametrit | Konteksti-ikkuna | Maksimi ulostulo |
|---|---|---|---|---|
| V4-Pro | 1,6 biljoonaa (MoE) | ~49B per token | 1M tokenia | 384K tokenia |
| V4-Flash | 284 miljardia (MoE) | ~13B per token | 1M tokenia | 384K tokenia |
Molemmat versiot ovat multimodaalisia (teksti, kuva, video), tukevat JSON-tulostusta ja työkalujen käyttöä, ja ne ovat saatavilla API- ja verkkoliittymän kautta .
| Muunnelma | Syöte (ei ruuhka-aika) | Ulostulo (ei ruuhka-aika) | Välimuistiosuma |
|---|---|---|---|
| V4-Pro | 0,435 $ | 0,87 $ | 90 % alennus |
| V4-Flash | 0,14 $ | 0,28 $ | 90 % alennus |
DeepSeek tarjosi myös 75 %:n alennuskampanjan V4-Prolla toukokuun 2026 alkuun saakka . Vertailun vuoksi GPT-5.5:n ulostulon hinta on noin 30 dollaria miljoonalta tokenilta, joten V4-Flash on noin 107 kertaa halvempi .
DeepSeek V4:n vertailutulokset kertovat monisyisen tarinan:
Tärkeä varoitus NIST CAISI -arvioinnista (toukokuu 2026): DeepSeekin itse raportoimat vertailuarvot väittävät olevansa GPT-5.4:n ja Opus 4.6:n tasolla, mutta CAISI:n riippumaton arviointi osoitti V4:n olevan "huomattavasti vähemmän kykenevä" ei-julkisissa vertailuissa, mikä viittaa siihen, että jotkin itse raportoidut tulokset saattavat olla liioiteltuja . Artificial Analysisin Intelligence Index antaa GPT-5.5:lle (korkea) pistemäärän 53 ja DeepSeek V4 Prolle (päättely, korkea työmäärä) 41 – GPT-5.5 on älykkäämpi ja nopeampi (69 vs. 56 tok/s), mutta DeepSeek on dramaattisesti halvempi (0,18 $ vs. 4,35 $/MTok päättelytilassa) .
Alibaban Qwen-tiimi esitteli Qwen 3.8 Maxin Shanghain World AI Conferencessa 19. heinäkuuta 2026 . Kyseessä on tiimin ensimmäinen lippulaivamalli, jossa on yli biljoona parametria.
| Ominaisuus | Yksityiskohta |
|---|---|
| Parametrit yhteensä | 2,4 biljoonaa (harva MoE) |
| Arkkitehtuuri | Mixture-of-Experts, multimodaalinen (teksti + visio vahvistettu) |
| Konteksti-ikkuna | 983 616 tokenia Qwen Cloudin päätepisteessä ; toistettu noin 1M joissakin lähteissä |
| Maksimi ulostulo | 64 000 tokenia |
| Lisenssi | Ei vielä julkaistu; Alibaba sanoo avoimien painojen tulevan "pian" |
Pay-as-you-go -hinnoittelua ei ole julkaistu. Pääsy on tällä hetkellä tilauspohjainen Qwen Chatin ja valittujen API-kumppaneiden kautta. BenchLM listaa Qwen 3.8 Max Preview -hinnoittelun "ei listattu" . Jotkut kolmannen osapuolen seurantasivustot näyttävät automaattihinnoittelun 1,50/5,00 dollaria miljoonalta syöte-/ulostulotokenilta, mutta Alibaba ei ole vahvistanut tätä .
Alibaba väittää Qwen 3.8:n olevan "toiseksi paras vain Fable 5:n jälkeen" (Anthropicin huippumalli Claude), mikä sijoittaisi sen GPT-5.5:n ja DeepSeek V4:n edelle Alibaban omassa rankingissa . Parannuksia väitetään tapahtuneen koodauksessa, ammatillisessa tuottavuudessa, täyden pinon kehityksessä, data-analyysissä ja toimistotyönkuluissa Qwen 3.7 Maxiin verrattuna .
Yhtäkään riippumatonta vertailuarvoa ei kuitenkaan ole julkaistu. BenchLM, vertailuarvoja seuraava sivusto, seuraa Qwen 3.8 Max Previewa 321 vertailuarvon osalta, joista 0 on vahvistettu 20. heinäkuuta 2026 mennessä . Kuten eräs analyysi totesi: "Qwen 3.8 on testaamisen arvoinen, mutta on liian aikaista kohdella sitä vakaana tuotantokorvaajana Kimi K3:lle, GPT-5.6 Solille tai Claude Fable 5:lle" .
Taustaksi Qwenin edeltäjät loivat vankan perustan: Qwen 3.6-Max-Preview (20. huhtikuuta 2026) oli 35B:n / 3B:n aktiivisen parametrin tekstipohjainen malli, jossa oli 262K:n konteksti ja joka väitti olevansa ykkönen kuudessa koodaus- ja agenttivertailussa . Qwen 3.7-Max (toukokuu 2026) laajensi konteksti-ikkunan 1 miljoonaan tokeniin ja lisäsi päättelyagenttiominaisuuksia . Kumpaakaan ei kuitenkaan yleisesti pidetty eturintaman tason mallina agenttikoodauksen ulkopuolella.
Alibaba sijoittaa Qwen 3.8:n nimenomaisesti "toiseksi parhaaksi Fable 5:n jälkeen" . Jos tämä väite pitää paikkansa riippumattomassa arvioinnissa, se sijoittaisi Qwen 3.8:n GPT-5.5:n ja DeepSeek V4:n edelle. Mutta ilman vahvistettuja vertailuarvoja tämä on edelleen markkinointiväite, ei vakiintunut tosiasia. Anthropicin Fable 5 näyttää olevan Alibaban oman kehystyksen mukaan tällä hetkellä tunnustettu eturintaman johtaja .
DeepSeekin aggressiivinen hinnoittelu on käynnistänyt kilpailun API-kustannusten pohjalle. V4-Flash hintaan 0,14 dollaria miljoonalta syötetyltä tokenilta on radikaalisti halvempi kuin mikään länsimainen eturintaman malli. Alibaba ei ole vielä asettanut Qwen 3.8:n hintaa, mutta Qwen 3.6 oli jo hinnoiteltu aggressiivisesti (noin 1,25/7,50 dollaria syöte/ulostulo) .
DeepSeek V4:n avoimet painot MIT-lisenssillä tarkoittavat, että oma käyttöönotto on myös mahdollista, mikä puristaa entisestään suljettujen lähdekoodien tarjoajien katteita . Kuten eräs analyysi totesi, käytännön vaikutus on se, että "kehittäjät voivat nyt käyttää lähes eturintaman kyvykkyyttä (koodaustehtävissä) murto-osalla GPT-5.5:n tai Clauden hinnasta."