Alibaban Qwen 3.7 Max, joka julkaistiin toukokuussa 2026, on 2,8 biljoonan parametrin sekoitettuasiantuntija (MoE) lippulaivamalli, joka vaikutti vertaisarvioinneissa vastaavan tai ylittävän Anthropicin Fable 5:n noin kuudesosalla kustannuksista . Suurille volyymeille Alibaban Qwen3.6 Flash maksaa vain 0,19 dollaria miljoonalta syöte tokenilta .
Zhipu AI:n GLM-5.2, joka julkaistiin 13. kesäkuuta 2026, käyttää 744 miljardin parametrin MoE-arkkitehtuuria (40 miljardia aktiivista) miljoonan tokenin konteksti-ikkunalla, ja se sijoittui ykköseksi avoimen painon mallien joukossa Artificial Analysis Intelligence Indexissä . Hinnoiteltuna 1,40 dollariin miljoonalta syöte tokenilta ja 4,40 dollariin miljoonalta tuotos tokenilta se alittaa yhdysvaltalaiset huippumallit noin 5–6 kertaisesti .
Moonshot AI:n Kimi K3, joka paljastettiin 16. heinäkuuta 2026, on suurin koskaan julkistettu avoimen painon tekoälyjärjestelmä: 2,8 biljoonaa parametria, miljoonan tokenin konteksti-ikkuna ja syntyperäinen visuaalinen ymmärrys . Moonshot lupasi täydet avoimet painot 27. heinäkuuta 2026 mennessä . Sen API-hinnoittelu on 3 dollaria miljoonalta syöte tokenilta ja 15 dollaria miljoonalta tuotos tokenilta, mikä tekee siitä kalleimman kiinalaisen mallin – mutta silti halvemman kuin vertailukelpoiset yhdysvaltalaiset tarjoukset .
Kustannusero kiinalaisten ja yhdysvaltalaisten huippumallien välillä on äärimmäinen:
| Malli | Syötehinta (per 1M tokenia) | Tuotoshinta (per 1M tokenia) |
|---|---|---|
| DeepSeek V4-Flash | 0,14 $ | 0,28 $ |
| Alibaba Qwen3.6 Flash | 0,19 $ | 1,13 $ |
| Zhipu GLM-5.2 | 1,40 $ | 4,40 $ |
| Alibaba Qwen3.7 Max | 1,25 $ | 3,75 $ |
| Moonshot Kimi K3 | 3,00 $ | 15,00 $ |
| Anthropic Claude Fable 5 (arvio) | ~15,00 $ | ~50,00 $ |
| OpenAI GPT-5.5 (arvio) | ~5,00 $ | ~15,00 $ |
Lähteet: Edellinen taulukko ja
Luvut kertovat tarinan: DeepSeekin V4-Flash maksaa arviolta 3 senttiä benchmark-testiä kohden, kun GPT-5.5 maksaa 1,86 dollaria ja Claude Fable 5 3,33 dollaria . Pääomasijoittaja Marc Andreessen huomautti, että GLM-5.2 oli ”ensimmäinen kiinalainen tekoälymalli, joka vastaa ja usein voittaa amerikkalaisten suurten laboratorioiden julkiset tekoälymallit ilman kompromisseja” – murto-osalla hinnasta .
Kiinan strategian toinen haara on avoimen painon julkaisu. Mallit, kuten GLM-5.2 (MIT-lisenssi), Kimi K3 (luvattu muunneltu MIT-lisenssi) ja Qwen-sarja, ovat vapaasti ladattavissa, mikä tarkoittaa, että kuka tahansa voi ajaa, muokata tai hienosäätää niitä ilman token-kohtaisia kustannuksia . Tämä ”mallien ilmaisjakelu” -strategia tyhjentää keskimarkkinan, jossa yhdysvaltalaiset yritykset aiemmin veloittivat korkeita hintoja .
Keskeinen käännekohta tapahtui kesäkuussa 2026, kun Trumpin hallinto pyysi Anthropicia lopettamaan kahden kehittyneimmän tekoälyjärjestelmänsä (Fable ja Mythos) toiminnan kansalliseen turvallisuuteen liittyvillä perusteilla . Kahden viikon kuluessa Z.ai esitteli mallin, joka kilpaili tiiviisti Anthropicin tarjonnan kanssa – edullisempi ja ilman Yhdysvaltain rajoituksia . Kiinalaiset yritykset näkivät tilaisuuden ja ryntäsivät täyttämään aukon .
Yhdysvaltain vastaus on ollut hajanainen. Anthropic noudatti hallituksen pyyntöä. Googlen raportoidaan kamppailevan Gemini-mallinsa uusimman version kanssa, kun kiinalaiset mallit kaventavat eroa . Mitään merkittävää koordinoitua Yhdysvaltain politiikkatoimenpidettä ei ole julkistettu; analyytikot huomauttavat, että sirujen vientivalvonta ei ole estänyt kiinalaisia yrityksiä saavuttamasta kilpailukykyistä suorituskykyä arkkitehtuurin tehokkuuden (esim. MoE, hybridi huomio) kautta raa'an laskentatehon sijaan .
Samaan aikaan yhdysvaltalaiset yritykset testaavat ja ottavat yhä enemmän käyttöön kiinalaisia malleja kustannussyistä, mikä heikentää entisestään amerikkalaisten tekoälylaboratorioiden kotikenttäetua .