Open weight modellen bereikten op de zaterdag vóór 25 augustus een recordaandeel van 62 procent van het tokenvolume op Vercels AI Gateway; op dinsdag was dat 54 procent tegenover 46 procent voor propriëtaire modellen. DeepSeek V4 Flash was de belangrijkste aanjager: nieuwe gewichten verbeterden de prestaties bij age...
Research answer

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
De machtsverhouding in AI-verkeer verschuift. Op dinsdag 25 augustus waren open-weight modellen goed voor 54 procent van alle tokens die via Vercels AI Gateway werden verwerkt. Propriëtaire modellen — modellen waarvan de gewichten niet openbaar beschikbaar zijn — kwamen uit op 46 procent. Op de zaterdag ervoor bereikten open modellen volgens de gerapporteerde cijfers zelfs een recordaandeel van 62 procent, tegenover 38 procent voor propriëtaire modellen.4
De directe aanjager was DeepSeek V4 Flash. Een update van de modelgewichten verbeterde de prestaties bij programmeren, toolgebruik en zogeheten agentic workflows, zonder dat het model veranderde in een premiumproduct.19
| Meetmoment in augustus | Open-weight modellen | Propriëtaire modellen |
|---|---|---|
| Zaterdag ervoor | 62% | 38% |
| Dinsdag 25 augustus | 54% | 46% |
Open modellen hadden daarmee op dinsdag een voorsprong van 8 procentpunt. Bij het eerdere record liep die voorsprong op tot 24 procentpunt.
Belangrijk: deze vergelijking gaat uitsluitend over het aantal tokens dat door de gateway is verwerkt. Het is geen maatstaf voor omzet, winst of het aantal bedrijven dat een bepaald model gebruikt.
Vercel meldde dat DeepSeek V4 Flash op AI Gateway standaard met bijgewerkte gewichten draaide. De score op Terminal-Bench steeg daarbij van 56,9 in de preview van april naar 82,7 — een verbetering van 25,8 punt.19 Bestaande gebruikers hoefden hun model-ID of applicatiecode niet aan te passen om de nieuwe gewichten te gebruiken.19
De aantrekkingskracht van het model ging daardoor verder dan alleen een lage prijs. Dankzij de betere prestaties bij agenttaken is V4 Flash geschikter voor grootschalige programmeer- en toolgebruik-workloads. Tegelijk biedt het model ontwikkelaars een manier om de inferentiekosten — de kosten voor het uitvoeren van een AI-model — onder controle te houden. Volgens Vercel ondersteunt V4 Flash redeneren, toolgebruik en impliciete caching, met een contextvenster van 1 miljoen tokens.27
Ook de prijsstructuur versterkte dat verschil. Reuters meldde dat DeepSeek V4 Pro werd gelanceerd tegen ongeveer negen keer de invoerprijs en veertien keer de uitvoerprijs van V4 Flash. Dat onderstreept het onderscheid tussen het efficiënte model en de duurdere vlaggenschipvariant.17 Onafhankelijke vergelijkingen laten eveneens een aanzienlijk prijsvoordeel voor V4 Flash zien, al verschillen benchmarkresultaten per test en configuratie.25
De beschikbare berichtgeving koppelt de daling van het volume voor propriëtaire modellen aan een zwakkere zakelijke vraag naar het duurdere Fable 5 van Anthropic.4 Dat is aannemelijk bij workloads waarbij ontwikkelaars meer waarde hechten aan hoge verwerkingssnelheid en lage kosten per eenheid dan aan de allerhoogste modelcapaciteit. De gatewaycijfers bewijzen echter niet dat dit voor iedere klant of elk verzoek de enige oorzaak was.
Fable 5 blijft volgens Vercels productbeschrijving gericht op langdurige, onduidelijke en uit meerdere stappen bestaande taken.3 De ontwikkeling lijkt daarom minder op een algemeen oordeel dat open modellen beter zijn. Het gaat eerder om routering: gebruik een goedkoper model voor grote hoeveelheden geschikt werk en reserveer dure propriëtaire modellen voor taken die hun hogere prijs rechtvaardigen.
Het belangrijkste voorbehoud is het verschil tussen gebruik en omzet. In eerdere rapportage van Vercel waren open-weight modellen goed voor 29 procent van het gateway-tokenvolume, terwijl ze minder dan 4 procent van de uitgaven vertegenwoordigden.44 Dat verschil ontstaat doordat een tokenaantal niets zegt over de prijs per invoer- of uitvoertoken.
De doorbraak in augustus betekent dus dat open modellen een groter deel van het werk op de gateway verwerkten — niet noodzakelijk dat ze meer inkomsten voor aanbieders genereerden. Propriëtaire modellen kunnen een onevenredig groot deel van de bestedingen behouden, ook wanneer goedkopere open modellen meer tokens verwerken.
De cijfers wijzen op een bewustere strategie voor modelroutering:
De bredere les uit het verkeer op Vercels AI Gateway is helder: open-weight modellen kunnen productievolume winnen wanneer ze voldoende capaciteit combineren met fors lagere kosten. DeepSeek V4 Flash is daarvan het duidelijkste voorbeeld. De onderliggende trend is niet dat ieder propriëtair model meteen overbodig wordt, maar dat ontwikkelaars voor elke taak steeds vaker het goedkoopste model kiezen dat betrouwbaar genoeg presteert.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Open weight modellen bereikten op de zaterdag vóór 25 augustus een recordaandeel van 62 procent van het tokenvolume op Vercels AI Gateway; op dinsdag was dat 54 procent tegenover 46 procent voor propriëtaire modellen.
Open weight modellen bereikten op de zaterdag vóór 25 augustus een recordaandeel van 62 procent van het tokenvolume op Vercels AI Gateway; op dinsdag was dat 54 procent tegenover 46 procent voor propriëtaire modellen. DeepSeek V4 Flash was de belangrijkste aanjager: nieuwe gewichten verbeterden de prestaties bij agenttaken aanzienlijk, terwijl het model zijn prijsvoordeel behield.
De verschuiving betekent niet automatisch dat open modellen het grootste deel van de bestedingen binnenhaalden; eerdere Vercel cijfers lieten zien dat propriëtaire aanbieders met minder tokens toch het grootste deel v...