Riippumattomat vertailuarvot NIST:n CAISI-arvioinnista osoittavat DeepSeek V4 Pron kilpailevan suoraan OpenAI:n ja Anthropicin parhaiden kanssa :
| Vertailuarvo | DeepSeek V4 Pro | OpenAI GPT-5.5 | Anthropic Opus 4.6 |
|---|---|---|---|
| GPQA Diamond (tieteellinen päättely) | 90,1 % | 96 % | 91 % |
| MMLU-Pro (yleistieto) | 87,5 % | ~92 % | 89,1 % |
| SWE-bench Verified (ohjelmointi) | 80,6 % | ~75 % | ~78 % |
Muita suorituskyvyn kohokohtia:
Kiinalaisen tekoälyn taloudellinen tarina on yhtä dramaattinen kuin tekninenkin:
Alibaba (Qwen) noudattaa avoimen lähdekoodin ekosysteemistrategiaa: useimmat mallit julkaistaan Apache 2.0 -lisenssillä, ne on helppo hienosäätää ja ne voi isännöidä itse ilmaiseksi . Tämä teki Qwenistä ladatuimman malliperheen Hugging Facessa. Haittapuolena on kaupallistaminen – Alibaban tekoäly on hitti, mutta siitä on vaikea tehdä suoraa rahantekijää, kuten New York Times raportoi
. Alibaba on kuitenkin alkanut kääntyä: lippulaiva Qwen 3.6 Max Preview julkaistiin suljettuna, yksityisenä API-mallina huhtikuussa 2026
.
DeepSeek noudattaa hybridilähestymistapaa: se julkaisee V4-painonsa avoimella MIT-lisenssillä (1,6 biljoonan parametrin Mixture-of-Experts, 49 miljardia aktiivista parametria) ja tarjoaa myös edullisen API-tason. Sen arkkitehtuuri – MoE erittäin harvalla aktivoinnilla – mahdollistaa huipputason suorituskyvyn dramaattisesti alhaisemmilla päättelykustannuksilla.
Länsimaiset vakiintuneet toimijat (OpenAI, Anthropic, Google) luottavat ensisijaisesti suljettuihin, omiin API-rajapintoihin korkealla hinnoittelulla. OpenAI ja Anthropic ovat vastauksena paineeseen julkaisseet halvempia "nano"- ja "mini"-tasoja, mutta yksikään niistä ei yllä DeepSeekin huipputason hinta-laatusuhteeseen .