| Varianta | Celkové parametry | Aktivní parametry | Kontextové okno | Max. výstup |
|---|---|---|---|---|
| V4-Pro | 1,6 bilionu (MoE) | ~49B na token | 1M tokenů | 384K tokenů |
| V4-Flash | 284 miliard (MoE) | ~13B na token | 1M tokenů | 384K tokenů |
Obě varianty jsou multimodální (text, obrázek, video), podporují JSON výstup a volání nástrojů a jsou dostupné přes API i web .
| Varianta | Vstup (mimo špičku) | Výstup (mimo špičku) | Cache Hit |
|---|---|---|---|
| V4-Pro | 0,435 USD | 0,87 USD | 90% sleva |
| V4-Flash | 0,14 USD | 0,28 USD | 90% sleva |
DeepSeek také spustil promoakci se 75% slevou na V4-Pro do začátku května 2026 . Pro srovnání: cena výstupu GPT-5.5 je přibližně 30 USD/MTok, takže V4-Flash je na výstupu zhruba 107× levnější .
Benchmarkové výsledky DeepSeek V4 vyprávějí nuancovaný příběh:
Důležité upozornění z nezávislého hodnocení NIST CAISI (květen 2026): DeepSeekovy vlastní benchmarky tvrdí srovnatelnost s GPT-5.4 a Opus 4.6, ale CAISI při nezávislém testování zjistilo, že V4 je na neveřejných testech „podstatně méně schopný“, což naznačuje možné nadhodnocení vlastních výsledků . Index inteligence Artificial Analysis hodnotí GPT-5.5 (high) na 53 bodů oproti DeepSeek V4 Pro (Reasoning, High Effort) na 41* – GPT-5.5 je inteligentnější a rychlejší (69 vs. 56 tok/s), ale DeepSeek je dramaticky levnější (0,18 USD vs. 4,35 USD/MTok v režimu uvažování) .
Tým Qwen z Alibaba představil Qwen 3.8 Max na Světové konferenci o AI v Šanghaji 19. července 2026 . Jde o první vlajkový model týmu nad 1 bilionem parametrů.
| Atribut | Detail |
|---|---|
| Celkové parametry | 2,4 bilionu (sparse MoE) |
| Architektura | Mixture-of-Experts, multimodální (text + potvrzené vidění) |
| Kontextové okno | 983 616 tokenů dle endpointu Qwen Cloud ; v některých zdrojích uváděno jako ~1M |
| Max. výstup | 64 000 tokenů |
| Licence | Zatím nezveřejněna; Alibaba slibuje otevřené váhy „brzy“ |
Průběžné ceny zaplatíš za použití nebyly zveřejněny. Přístup je v současnosti možný pouze prostřednictvím předplatného přes Qwen Chat a vybrané API partnery. BenchLM uvádí cenu Qwen 3.8 Max Preview jako „neuvedeno“ . Některé třetí strany uvádějí automatické ceny 1,50/5,00 USD za milion vstupních/výstupních tokenů, ale Alibaba to nepotvrdila .
Alibaba prohlašuje, že Qwen 3.8 je „druhý nejlepší po Fable 5“ (nejlepší model Claude od Anthropicu), což by ho v žebříčku Alibaba řadilo před GPT-5.5 a DeepSeek V4 . Zlepšení se údajně týkají kódování, profesionální produktivity, vývoje celých aplikací, analýzy dat a kancelářských workflow oproti Qwen 3.7 Max .
Nebyl však zveřejněn jediný nezávislý benchmark. BenchLM, web sledující benchmarky, eviduje k 20. červenci 2026 pro Qwen 3.8 Max Preview 321 benchmarků s 0 ověřenými výsledky . Jak uvádí jedna analýza: „Qwen 3.8 stojí za testování, ale je příliš brzy brát ho jako stabilní produkční náhradu za Kimi K3, GPT-5.6 Sol nebo Claude Fable 5“ .
Pro srovnání: předchůdci Qwen položili solidní základy. Qwen 3.6-Max-Preview (20. dubna 2026) byl model s 35B celkových / 3B aktivních parametrů, pouze pro text, s kontextem 262K, který si nárokoval #1 v šesti kódovacích a agentních benchmarcích . Qwen 3.7-Max (květen 2026) rozšířil kontext na 1M tokenů a přidal schopnosti agentního uvažování . Ani jeden však obecně nebyl považován za špičkový mimo agentní kódování.
Alibaba výslovně staví Qwen 3.8 jako „druhý nejlepší po Fable 5“ . Pokud by se toto tvrzení potvrdilo nezávislým testováním, Qwen 3.8 by se umístil před GPT-5.5 a daleko před DeepSeek V4. S nulovými ověřenými benchmarky to však zůstává marketingovým tvrzením, nikoli prokázaným faktem. Fable 5 od Anthropicu je podle samotného rámce Alibaba aktuálně uznávaným lídrem na špici .
Agresivní ceny DeepSeek odstartovaly závod ke dnu v cenách API. V4-Flash za 0,14 USD/M vstupu je radikálně levnější než jakýkoli západní špičkový model. Alibaba zatím cenu Qwen 3.8 nestanovila, ale Qwen 3.6 byl již cenově agresivní (~1,25/7,50 USD vstup/výstup) .
Otevřená MIT licence DeepSeek V4 umožňuje i provoz na vlastní infrastruktuře, což dále stlačuje marže uzavřených poskytovatelů . Jak poznamenala jedna analýza, praktickým důsledkem je, že „vývojáři nyní mají přístup ke schopnostem blížícím se špičce (v kódovacích úlohách) za zlomek ceny GPT-5.5 nebo Claude.“