Zhipu AIs GLM-5.2, udgivet 13. juni 2026, bruger en 744-milliarder-parameters MoE-arkitektur (40 milliarder aktive) med et 1-million-token kontekstvindue og blev rangeret som den bedste open-weight-model på Artificial Analysis Intelligence Index . Med en pris på $1,40 per million input-tokens og $4,40 per million output underbyder den amerikanske frontmodeller med omkring 5-6 gange
.
Moonshot AIs Kimi K3, afsløret 16. juli 2026, er det største open-weight AI-system, der nogensinde er annonceret: 2,8 billioner parametre i alt, et 1-million-token kontekstvindue og indbygget visuel forståelse . Moonshot lovede fulde open weights senest 27. juli 2026
. Dens API-pris ligger på $3 per million input-tokens og $15 per million output, hvilket gør den til den dyreste kinesiske model – men stadig under sammenlignelige amerikanske tilbud
.
Priskløften mellem kinesiske og amerikanske frontmodeller er ekstrem:
Tallene taler for sig selv: DeepSeeks V4-Flash koster anslået 3 cents per benchmarktest mod $1,86 for GPT-5.5 og $3,33 for Claude Fable 5 . Venturekapitalisten Marc Andreessen noterede, at GLM-5.2 var 'den første kinesiske AI-model, der matcher og ofte slår de amerikanske store laboratoriers offentlige AI-modeller uden kompromiser' – til en brøkdel af prisen
.
Den anden del af Kinas strategi er open-weight-udgivelse. Modeller som GLM-5.2 (MIT-licens), Kimi K3 (lovet Modified MIT-licens) og Qwen-serien er frit tilgængelige til download, hvilket betyder, at enhver kan køre, justere eller finjustere dem uden per-token-omkostninger . Denne 'giv-modellerne-væk'-strategi udhuler mellemmarkedet, hvor amerikanske virksomheder tidligere kunne opkræve premiumpriser
.
Et afgørende vendepunkt kom i juni 2026, da Trump-administrationen bad Anthropic om at indstille driften af sine to mest avancerede AI-systemer (Fable og Mythos) af nationale sikkerhedshensyn . Inden for to uger afslørede Z.ai en model, der lå tæt op ad Anthropics tilbud – mere prisvenlig og uden amerikanske restriktioner
. Kinesiske virksomheder så en åbning og skyndte sig at udfylde den
.
Den amerikanske reaktion har været fragmenteret. Anthropic efterkom regeringens anmodning. Google kæmper angiveligt med den nyeste version af sin Gemini-model, mens kinesiske modeller indhenter det . Der er ikke annonceret nogen større koordineret amerikansk politisk modforanstaltning; analytikere bemærker, at eksportkontrol på chips ikke har forhindret kinesiske virksomheder i at opnå konkurrencedygtig ydeevne gennem arkitektonisk effektivitet (f.eks. MoE, hybrid attention) snarere end rå computerkraft
.