Alibaba's Qwen 3.7 Max, gelanceerd in mei 2026, is een vlaggenschip met 2,8 biljoen parameters en een mixture-of-experts (MoE) architectuur. Het leek Anthropics Fable 5 te evenaren of overtreffen op benchmarks, voor ongeveer een zesde van de kosten . Voor grootschalig gebruik kost Alibaba's Qwen3.6 Flash slechts $0,19 per miljoen input tokens .
Zhipu AI's GLM-5.2, uitgebracht op 13 juni 2026, gebruikt een MoE-architectuur met 744 miljard parameters (40 miljard actief) en een contextvenster van 1 miljoen tokens. Het stond als #1 genoteerd in de Artificial Analysis Intelligence Index voor open-weight modellen . Geprijsd op $1,40 per miljoen input tokens en $4,40 per miljoen output, onderbiedt het Amerikaanse topmodellen met ongeveer een factor 5 tot 6 .
Moonshot AI's Kimi K3, onthuld op 16 juli 2026, is het grootste open-weight AI-systeem ooit aangekondigd: in totaal 2,8 biljoen parameters, een contextvenster van 1 miljoen tokens en native visueel begrip . Moonshot beloofde de volledige gewichten openbaar te maken op 27 juli 2026 . De API-prijs is $3 per miljoen input tokens en $15 per miljoen output, waarmee het het duurste Chinese model is – maar nog steeds onder vergelijkbare Amerikaanse aanbiedingen .
Het kostenverschil tussen Chinese en Amerikaanse topmodellen is extreem:
| Model | Input Prijs (per 1M tokens) | Output Prijs (per 1M tokens) |
|---|---|---|
| DeepSeek V4-Flash | $0,14 | $0,28 |
| Alibaba Qwen3.6 Flash | $0,19 | $1,13 |
| Zhipu GLM-5.2 | $1,40 | $4,40 |
| Alibaba Qwen3.7 Max | $1,25 | $3,75 |
| Moonshot Kimi K3 | $3,00 | $15,00 |
| Anthropic Claude Fable 5 (geschat) | ~$15,00 | ~$50,00 |
| OpenAI GPT-5.5 (geschat) | ~$5,00 | ~$15,00 |
Bronnen: Gebaseerd op eerdere tabel en
De cijfers spreken voor zich: DeepSeeks V4-Flash kost naar schatting 3 cent per benchmarktest, tegenover $1,86 voor GPT-5.5 en $3,33 voor Claude Fable 5 . Venture capitalist Marc Andreessen merkte op dat GLM-5.2 "het eerste Chinese AI-model was dat de publieke AI-modellen van de grote Amerikaanse laboratoria evenaarde en vaak versloeg, zonder compromissen" – voor een fractie van de prijs .
Het tweede element van China's strategie is de open-weight release. Modellen zoals GLM-5.2 (MIT-licentie), Kimi K3 (toegezegde Modified MIT-licentie) en de Qwen-serie zijn vrij downloadbaar, wat betekent dat iedereen ze kan draaien, aanpassen of finetunen zonder per-token kosten . Deze strategie van "weggeven van modellen" holt de middenmarkt uit waar Amerikaanse bedrijven voorheen premieprijzen konden vragen .
Een belangrijk keerpunt kwam in juni 2026, toen de regering-Trump Anthropic vroeg om de activiteiten van zijn twee meest geavanceerde AI-systemen (Fable en Mythos) stop te zetten vanwege nationale veiligheidsoverwegingen . Binnen twee weken onthulde Z.ai een model dat nauw aansloot bij de aanbiedingen van Anthropic – voordeliger en zonder Amerikaanse beperkingen . Chinese bedrijven zagen een opening en haastten zich deze te vullen .
De Amerikaanse reactie is gefragmenteerd. Anthropic voldeed aan het verzoek van de overheid. Google heeft naar verluidt moeite met de nieuwste versie van zijn Gemini-model nu Chinese modellen de kloof dichten . Er is geen gecoördineerde Amerikaanse beleidsmaatregel aangekondigd; analisten merken op dat exportcontroles op chips Chinese bedrijven er niet van hebben weerhouden concurrerende prestaties te leveren door architecturale efficiëntie (bv. MoE, hybride aandacht) in plaats van brute rekenkracht .
Ondertussen testen en adopteren Amerikaanse bedrijven steeds vaker Chinese modellen om kostenredenen, wat het thuisvoordeel van Amerikaanse AI-laboratoria verder uitholt .