Hier is een uitgebreid antwoord dat al je vragen beantwoordt.
Wat is GLM-5.2?
GLM-5.2 is het paradepaardje van Z.AI (voorheen Zhipu AI, gevestigd in Peking) en werd op 13 juni 2026 uitgebracht onder de MIT-licentie ![]()
. Het is een Mixture-of-Experts (MoE)-model met in totaal 753 miljard parameters, waarvan er ongeveer 40 miljard actief zijn per token. Het model is speciaal gebouwd voor langdurige codeertaken, agentische taken en complexe software-engineering ![]()
. De gewichten zijn beschikbaar op Hugging Face
.
Benchmarkprestaties
Artificial Analysis Intelligence Index
- GLM-5.2 scoort 51 op de Artificial Analysis Intelligence Index v4.1 — de hoogste score ooit voor een open-weight model
![]()
![]()
.
- Dit plaatst het op de 4e plaats overall op het volledige klassement, alleen achter Claude Fable 5 (60), Claude Opus 4.8 (56) en GPT-5.5 (geschat ~53-55)
![]()
.
- Het verslaat andere Chinese open-weight rivalen: MiniMax-M3 (44), DeepSeek V4 Pro Max (44) en Kimi K2.6 (43)
![]()
.
- Op de Coding Index van Artificial Analysis scoort het 68.8, beter dan 99% van de gevolgde modellen
.
- Het model bevindt zich ook op de Pareto-grens van de Intelligentie vs. Kosten-per-taak grafiek, wat betekent dat geen enkel ander open-weight model deze capaciteit biedt tegen lagere kosten per taak
.
Belangrijke codeer- en redeneerbenchmarks
| Benchmark | Score | Context |
|---|
| FrontierSWE (langdurig coderen) | 74,4% | Verslaat GPT-5.5 (72,6) met ~1%; blijft 1% achter op Claude Opus 4.8 ![]() ![]() ![]() |
| Terminal-Bench 2.1 | 81,0 | Nieuw open-weight record ![]() ![]() |
| SWE-bench Pro | 62,1 | Hoogste open-weight score ooit ![]() ![]() ![]() |
| SWE-bench Verified | 76,4% | Competitief met grensverleggende modellen ![]() |
| GPQA Diamond (wetenschappelijk redeneren) | 80,3% | Sterk op moeilijke wetenschappelijke vragen ![]() ![]() |
| AIME 2025 (wiskundig redeneren) | 86,67% | Topprestatie op het gebied van wiskunde ![]() |
| MMLU-Pro | 80,63% | Brede academische kennis ![]() |
| MMLU | 91,72% | Algemene kennisbenchmark ![]() |
| Humanity's Last Exam (met tools) | 54,7% | +12 punten t.o.v. vorige generatie ![]() |
| ProofBench | >30% | Eerste open-weight model dat boven 30% scoort — 11 punten beter dan concurrentie ![]() |
| WebDev Arena | #1 | Passeerde Claude Fable 5 en Opus 4.8 op door mensen beoordeelde frontend-ranglijst ![]() |
Volgens Vals AI scoorde GLM-5.2 het beste van alle modellen (inclusief closed-source) op vijf benchmarks: Vals Index, Harvey's Legal Agent Benchmark, Finance Agent v2, ProofBench en Vibe Code Bench
.
Architectuur
GLM-5.2 behoudt hetzelfde 744B totaal / 40B actief MoE-ontwerp als zijn voorganger GLM-5.1, maar introduceert twee belangrijke architecturale innovaties ![]()
:
- IndexShare — Een nieuwe optimalisatie voor sparse attention die een enkele, lichte indexer hergebruikt over elke vier Sparse Attention-lagen, waardoor het aantal FLOP's per token bij 1M context met ongeveer 2,9× wordt verminderd
![]()
![]()
.
- Verbeterde Multi-Token Prediction (MTP) — Verbeterde speculatieve decoderinglaag die de acceptatielengte met maximaal 20% verhoogt, wat de latentie bij lange uitvoer vermindert
![]()
.
Belangrijkste specificaties
- Contextvenster: 1 miljoen tokens (bruikbaar, niet alleen theoretisch)
![]()
![]()
- Maximale uitvoer: 131.072 tokens per generatie
![]()
![]()
![]()
- Denkniveaus: "Hoog" en "Max" inspanningsniveaus voor diepere redenering
![]()
![]()
- Licentie: MIT (volledig open-weight)
![]()
![]()
![]()
Kosten
API-prijzen (per 1M tokens, van Z.AI's officiële documentatie)
| Item | Prijs |
|---|
| Invoertokens | $1,40 |
| Uitvoertokens | $4,40 |
| In cache opgeslagen invoer | $0,26 (opslag tijdelijk gratis) |
![]()
![]()
Concurrentiële context
- GLM-5.2 kost ongeveer 1/6 van de prijs per token van GPT-5.5 en Claude Opus 4.8 voor vergelijkbare of betere codeerprestaties
![]()
.
- Ook beschikbaar via abonnement: GLM Coding Plan-tarieven van ~$10/maand (Lite), ~$30/maand (Pro) en ~$80/maand (Max), per kwartaal gefactureerd
.
- Z.AI bevindt zich op de Pareto-grens voor Intelligentie vs. Kosten per Taak
.
Tech-CEO's die GLM-5.2 prezen
- Guillermo Rauch (CEO van Vercel) — Zei dat hij "oprecht onder de indruk, bijna geschokt" was over de codeercapaciteiten van GLM-5.2 en voegde eraan toe dat het model "de zaken verandert"
.
- Elon Musk — Like sociale media-berichten over het model, wat zijn goedkeuring signaleert
.
- Aaron Levie (CEO van Box) — Sprak een sterke positieve reactie uit over de mogelijkheden van het model
.
- De westerse tech-gemeenschap beschreef de week van de release breed als "een van de beste weken aller tijden" voor open-source AI
.
Strategische context
Amerikaanse Entity List en exportcontroles
- Z.AI (Zhipu AI) werd in januari 2025 toegevoegd aan de Amerikaanse Entity List, waardoor de toegang tot geavanceerde halfgeleiders en chipmateriaal werd beperkt
.
- De release kwam kort nadat de Amerikaanse regering de stopzetting van Anthropic's Claude Fable-service had bevolen, een directe concurrent
. Z.AI-oprichter Jie Tang verwees expliciet naar die stopzetting in zijn aankondiging en positioneerde GLM-5.2 als een open alternatief ![]()
.
- Op 15 juni 2026 steeg het aandeel van Zhipu met 33% nadat Wall Street zijn inzet op Chinese AI-bedrijven verhoogde nadat Washington de beperkingen op buitenlandse toegang tot geavanceerde Amerikaanse modellen had aangescherpt
.
Hongkong IPO
- Zhipu AI voltooide zijn IPO op de Hong Kong Stock Exchange op 8 januari 2026 en haalde ongeveer HKD 4,35 miljard (~$558 miljoen) op met een marktkapitalisatie van bijna $52,83 miljard
. Het bedrijf staat onder leiding van CEO Zhang Peng.
Chinese open-weight modellen vs. Westerse grensverleggende AI
- GLM-5.2 is het duidelijkste signaal dat Chinese open-weight modellen de kloof met westerse propriëtaire grensverleggende modellen hebben gedicht. Op verschillende codeerbenchmarks verslaat het nu GPT-5.5 en zit het binnen 1% van Claude Opus 4.8
![]()
.
- Het model toont aan dat exportcontroles het vermogen van Chinese AI-labs om te innoveren op het gebied van architectuur (IndexShare) en concurrerende benchmarkresultaten te behalen, niet hebben vertraagd
![]()
.
- De strategie van Z.AI combineert een open-weight release (MIT-licentie), agressieve prijzen (~1/6 van de kosten van gesloten grensmodellen) en een focus op langdurige agentische codeertaken — direct gericht op het ontwikkelaarspubliek dat westerse labs hebben gedomineerd
![]()
.
- Hugging Face, de grootste open-source AI-gemeenschap, heeft persoonlijk zes uur gratis wereldwijde rekenkracht gefinancierd voor GLM-5.2-inferentie, wat de inzet van het platform op Chinese open-weight modellen signaleert
.
- De release veroorzaakt een bredere concurrentiedynamiek: als Chinese open-weight modellen op dit traject blijven, wordt het onderscheid dat westerse labs in rekening brengen voor closed-source toegang moeilijker te rechtvaardigen, vooral bij kosten gevoelige codeer- en agentische workloads.