De prijzen zijn $0,435 per miljoen invoertokens en $0,87 per miljoen uitvoertokens tegen standaardtarieven, met cache-kortingen tot 97% . In de maximale inspanningsmodus zijn de prijzen $1,32/$3,96 per miljoen tokens
.
Moonshot AI bracht uit wat het "s werelds eerste open model in de 3 biljoen-parameter klasse" noemt – een 2,8 biljoen parameter Mixture-of-Experts-model dat 16 van de 896 experts per token activeert, met een contextvenster van 1 miljoen tokens en native multimodale (beeld + tekst) mogelijkheden . De volledige gewichten werden op 27 juli op Hugging Face uitgebracht onder een aangepaste MIT-licentie
. Het is live op Kimi.com, Kimi Work, Kimi Code en de Kimi API
.
Het model dat de golf startte. GLM-5.2 is een MoE van 744 miljard parameters met ongeveer 40 miljard actieve per token, een contextvenster van 1 miljoen tokens en een MIT-licentie . De CAISI-beoordeling van NIST geeft aan dat de algemene mogelijkheden vergelijkbaar zijn met GPT-5.2 (december 2025) en de cybermogelijkheden vergelijkbaar met Claude Opus
. Het scoort 81,0 op Terminal-Bench 2.1 en 62,1 op SWE-bench Pro – de hoogste open-weight score op de Artificial Analysis Intelligence Index
. De API-prijzen liggen ongeveer 10 keer lager dan die van Claude of GPT-5
.
Een MoE van 1,6 biljoen parameters (48 miljard actief per token) met een contextvenster van 1 miljoen tokens, uitgebracht onder een MIT-licentie . Het cruciale onderscheid: het eerste biljoen-parameter model dat volledig is getraind en draait op Chinese chips – een cluster van 50.000 Huawei Ascend 910B/C-chips
. Volgens Meituan's eigen tests overtreft het GPT-5.5 op software-engineering benchmarks
. Het stond rustig bovenaan de OpenLLM-ranglijst als "Owl Alpha" voor de officiële release
. De API-prijzen zijn $0,75/$2,95 per miljoen invoer-/uitvoertokens, met een lanceerpromotie van $0,30/$1,20
.
Er zijn geen bronnen gevonden voor specifieke taakprijzen van $0,06 voor DeepSeek V4 Pro of $2,34 voor Claude Opus 5. Ook voor Tencent Hy3 en Alibaba Qwen3.8-Max ontbreken geverifieerde specificaties of releasedata. Beweringen over een recent open-source manifest van Mark Zuckerberg konden niet worden bevestigd.
Dit artikel is gebaseerd op beschikbaar bewijs van medio augustus 2026. Alle beweringen over modelcapaciteiten komen van door ontwikkelaars gerapporteerde benchmarks en beoordelingen door derden (waaronder NIST's CAISI). Onafhankelijke verificatie van alle benchmarkscores is gaande in de hele industrie. Kostenvergelijkingen zijn gebaseerd op gepubliceerde API-tokenprijzen; de werkelijke kosten per taak variëren aanzienlijk per taakcomplexiteit, contextlengte en cache-hitratio.