| 744B kokonaisparametria, 40B aktiivisena, 1M tokenin kontekstin pituus; listattu parhaaksi avoimen painon malliksi Artificial Analysis Intelligence -indeksissä |
| DeepSeek | V4-Flash / V4-Pro | Kesä–elokuu 2026 | V4-Flash 0,14 $ miljoonalta tokenilta; V4-Pro 0,435 $ miljoonalta tokenilta kesäkuun hinnanalennuksen jälkeen |
| Alibaba | Qwen 3.7 Max / Plus / Flash | Touko–kesäkuu 2026 | 2,8T parametrin MoE-lippulaiva; Qwen3.7 Max 1,25/3,75 $ / miljoona tokenia; Qwen3.6 Flash 0,19/1,13 $ |
| Moonshot AI | Kimi K3 | 16. heinäkuuta 2026 | 2,8T kokonaisparametria, ~50B aktiivisena, 1M kontekstin pituus; avoimet painot luvattu 27. heinäkuuta mennessä |
| Z.ai | Fable 5 -kilpailija | Kesäkuun loppu 2026 | Julkaistiin pian sen jälkeen, kun Anthropic lopetti kaksi kehittynyttä kehitysmallia Yhdysvaltain hallituksen pyynnöstä |
Hintakuilu on äärimmäinen. DeepSeekin V4-Flash veloittaa 0,14 dollaria miljoonalta tokenilta – yli 100 kertaa halvempi kuin Anthropicin Claude Fable 5 . Alibaban Qwen3.6 Flash maksaa 0,19 dollaria miljoonalta tokenilta, kun yhdysvaltalaiset huippumallit kuten GPT-5.5 ja Claude Opus 4.8 maksavat noin 7–12 kertaa enemmän vastaavilla suorituskykytasoilla . Moonshotin K3, joka on huippuluokan malli, tarjoaa API-hinnoitteluksi 3 dollaria miljoonalta syöttö- ja 15 dollaria miljoonalta tulostus-tokenilta, ja avoimet painot luvataan ilmaiselle itsepalvelukäytölle .