Zhipu AI:n GLM-5.2, joka julkaistiin 13. kesäkuuta 2026, käyttää 744 miljardin parametrin MoE-arkkitehtuuria (40 miljardia aktiivista) miljoonan tokenin konteksti-ikkunalla, ja se sijoittui ykköseksi avoimen painon mallien joukossa Artificial Analysis Intelligence Indexissä . Hinnoiteltuna 1,40 dollariin miljoonalta syöte tokenilta ja 4,40 dollariin miljoonalta tuotos tokenilta se alittaa yhdysvaltalaiset huippumallit noin 5–6 kertaisesti
.
Moonshot AI:n Kimi K3, joka paljastettiin 16. heinäkuuta 2026, on suurin koskaan julkistettu avoimen painon tekoälyjärjestelmä: 2,8 biljoonaa parametria, miljoonan tokenin konteksti-ikkuna ja syntyperäinen visuaalinen ymmärrys . Moonshot lupasi täydet avoimet painot 27. heinäkuuta 2026 mennessä
. Sen API-hinnoittelu on 3 dollaria miljoonalta syöte tokenilta ja 15 dollaria miljoonalta tuotos tokenilta, mikä tekee siitä kalleimman kiinalaisen mallin – mutta silti halvemman kuin vertailukelpoiset yhdysvaltalaiset tarjoukset
.
Kustannusero kiinalaisten ja yhdysvaltalaisten huippumallien välillä on äärimmäinen:
Luvut kertovat tarinan: DeepSeekin V4-Flash maksaa arviolta 3 senttiä benchmark-testiä kohden, kun GPT-5.5 maksaa 1,86 dollaria ja Claude Fable 5 3,33 dollaria . Pääomasijoittaja Marc Andreessen huomautti, että GLM-5.2 oli ”ensimmäinen kiinalainen tekoälymalli, joka vastaa ja usein voittaa amerikkalaisten suurten laboratorioiden julkiset tekoälymallit ilman kompromisseja” – murto-osalla hinnasta
.
Kiinan strategian toinen haara on avoimen painon julkaisu. Mallit, kuten GLM-5.2 (MIT-lisenssi), Kimi K3 (luvattu muunneltu MIT-lisenssi) ja Qwen-sarja, ovat vapaasti ladattavissa, mikä tarkoittaa, että kuka tahansa voi ajaa, muokata tai hienosäätää niitä ilman token-kohtaisia kustannuksia . Tämä ”mallien ilmaisjakelu” -strategia tyhjentää keskimarkkinan, jossa yhdysvaltalaiset yritykset aiemmin veloittivat korkeita hintoja
.
Keskeinen käännekohta tapahtui kesäkuussa 2026, kun Trumpin hallinto pyysi Anthropicia lopettamaan kahden kehittyneimmän tekoälyjärjestelmänsä (Fable ja Mythos) toiminnan kansalliseen turvallisuuteen liittyvillä perusteilla . Kahden viikon kuluessa Z.ai esitteli mallin, joka kilpaili tiiviisti Anthropicin tarjonnan kanssa – edullisempi ja ilman Yhdysvaltain rajoituksia
. Kiinalaiset yritykset näkivät tilaisuuden ja ryntäsivät täyttämään aukon
.
Yhdysvaltain vastaus on ollut hajanainen. Anthropic noudatti hallituksen pyyntöä. Googlen raportoidaan kamppailevan Gemini-mallinsa uusimman version kanssa, kun kiinalaiset mallit kaventavat eroa . Mitään merkittävää koordinoitua Yhdysvaltain politiikkatoimenpidettä ei ole julkistettu; analyytikot huomauttavat, että sirujen vientivalvonta ei ole estänyt kiinalaisia yrityksiä saavuttamasta kilpailukykyistä suorituskykyä arkkitehtuurin tehokkuuden (esim. MoE, hybridi huomio) kautta raa'an laskentatehon sijaan
.