Alibabas Qwen 3.7 Max, lanceret i maj 2026, er en flagskibsmodel med 2,8 billioner parametre og en mixture-of-experts (MoE)-arkitektur, der syntes at matche eller overgå Anthropics Fable 5 på benchmarks til omkring en sjettedel af prisen . Til højvolumenbrug koster Alibabas Qwen3.6 Flash kun $0,19 per million input-tokens .
Zhipu AIs GLM-5.2, udgivet 13. juni 2026, bruger en 744-milliarder-parameters MoE-arkitektur (40 milliarder aktive) med et 1-million-token kontekstvindue og blev rangeret som den bedste open-weight-model på Artificial Analysis Intelligence Index . Med en pris på $1,40 per million input-tokens og $4,40 per million output underbyder den amerikanske frontmodeller med omkring 5-6 gange .
Moonshot AIs Kimi K3, afsløret 16. juli 2026, er det største open-weight AI-system, der nogensinde er annonceret: 2,8 billioner parametre i alt, et 1-million-token kontekstvindue og indbygget visuel forståelse . Moonshot lovede fulde open weights senest 27. juli 2026 . Dens API-pris ligger på $3 per million input-tokens og $15 per million output, hvilket gør den til den dyreste kinesiske model – men stadig under sammenlignelige amerikanske tilbud .
Priskløften mellem kinesiske og amerikanske frontmodeller er ekstrem:
| Model | Input-pris (per 1M tokens) | Output-pris (per 1M tokens) |
|---|---|---|
| DeepSeek V4-Flash | $0,14 | $0,28 |
| Alibaba Qwen3.6 Flash | $0,19 | $1,13 |
| Zhipu GLM-5.2 | $1,40 | $4,40 |
| Alibaba Qwen3.7 Max | $1,25 | $3,75 |
| Moonshot Kimi K3 | $3,00 | $15,00 |
| Anthropic Claude Fable 5 (est.) | ~$15,00 | ~$50,00 |
| OpenAI GPT-5.5 (est.) | ~$5,00 | ~$15,00 |
Kilder: Tidligere tabel og
Tallene taler for sig selv: DeepSeeks V4-Flash koster anslået 3 cents per benchmarktest mod $1,86 for GPT-5.5 og $3,33 for Claude Fable 5 . Venturekapitalisten Marc Andreessen noterede, at GLM-5.2 var 'den første kinesiske AI-model, der matcher og ofte slår de amerikanske store laboratoriers offentlige AI-modeller uden kompromiser' – til en brøkdel af prisen .
Den anden del af Kinas strategi er open-weight-udgivelse. Modeller som GLM-5.2 (MIT-licens), Kimi K3 (lovet Modified MIT-licens) og Qwen-serien er frit tilgængelige til download, hvilket betyder, at enhver kan køre, justere eller finjustere dem uden per-token-omkostninger . Denne 'giv-modellerne-væk'-strategi udhuler mellemmarkedet, hvor amerikanske virksomheder tidligere kunne opkræve premiumpriser .
Et afgørende vendepunkt kom i juni 2026, da Trump-administrationen bad Anthropic om at indstille driften af sine to mest avancerede AI-systemer (Fable og Mythos) af nationale sikkerhedshensyn . Inden for to uger afslørede Z.ai en model, der lå tæt op ad Anthropics tilbud – mere prisvenlig og uden amerikanske restriktioner . Kinesiske virksomheder så en åbning og skyndte sig at udfylde den .
Den amerikanske reaktion har været fragmenteret. Anthropic efterkom regeringens anmodning. Google kæmper angiveligt med den nyeste version af sin Gemini-model, mens kinesiske modeller indhenter det . Der er ikke annonceret nogen større koordineret amerikansk politisk modforanstaltning; analytikere bemærker, at eksportkontrol på chips ikke har forhindret kinesiske virksomheder i at opnå konkurrencedygtig ydeevne gennem arkitektonisk effektivitet (f.eks. MoE, hybrid attention) snarere end rå computerkraft .
I mellemtiden tester og adopterer amerikanske virksomheder i stigende grad kinesiske modeller af omkostningshensyn, hvilket yderligere udhuler hjemmebanefordelen for amerikanske AI-laboratorier .