DeepSeek V4 Flash stond in de week van 27 juli tot en met 2 augustus bovenaan de OpenRouter ranglijst met 7,22 biljoen verwerkte tokens, maar die periode begon vóór de officiële release van de 0731 versie. De routeprijs van V4 Flash 0731 op OpenRouter bedraagt $0,05 per miljoen invoertokens en $0,16 per miljoen uitv...
Research answer

Create a landscape editorial hero image for this Studio Global article: How did DeepSeek V4-Flash, launched in public API beta on July 31, 2026, become OpenRouter’s most-used model within four days—reaching 7.1 t. Article summary: The reported surge is best explained by an unusually strong cost–capability–context combination, amplified by OpenRouter’s low-friction routing and likely substantial trial traffic—not by architecture alone. But several . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
DeepSeek-V4-Flash-0731 werd een opvallende test voor hoe snel de standaardkeuze voor AI-modellen kan verschuiven. De mix van lage tokenprijzen, een zeer groot contextvenster en directe beschikbaarheid via een modelaggregator bleek genoeg om veel experimenten op gang te brengen.
Volgens berichtgeving stond DeepSeek V4 Flash in de wekelijkse OpenRouter-ranglijst van 27 juli tot en met 2 augustus op de eerste plaats, met 7,22 biljoen verwerkte tokens. Dat is een indrukwekkend cijfer, maar het verdient wel context. 5
De build van 31 juli is een sparse mixture-of-experts-model (MoE): 284 miljard parameters in totaal, waarvan per token 13 miljard actief zijn. OpenRouter vermeldt een contextvenster van 1.310.720 tokens en positioneert het model voor programmeren, redeneren en agent-workflows. 1
Dat is vooral aantrekkelijk voor werk waarbij het tokenvolume snel oploopt:
De MoE-architectuur bewijst op zichzelf niet dat een model in de praktijk goedkoper of beter is. Het economische idee erachter is dat slechts een deel van alle parameters per token wordt geactiveerd. Dat moet veel modelcapaciteit mogelijk maken zonder het rekenprofiel per token van een even groot dicht model. Of een toepassing daar werkelijk van profiteert, hangt echter ook af van latency, beschikbare capaciteit bij aanbieders, routing, promptontwerp en uitvoerlengte.
TechNode meldde voor de week van 27 juli tot en met 2 augustus 7,22 biljoen tokens voor DeepSeek V4 Flash op OpenRouter. Dezelfde berichtgeving stelde dat Chinese modellen de eerste vier plaatsen bezetten en dat DeepSeek V4 Flash 0731 en V4 Pro beide in de top zes stonden. 5
De week begon echter vóór de publieke bèta-release van 31 juli. V4 Flash bestond al als previewroute; de 0731-release verving die preview op het API-eindpunt deepseek-v4-flash. 3 Het weektotaal mag dus niet worden gepresenteerd alsof het volledig door de nieuwe 0731-versie is veroorzaakt.
Ook gratis toegang is een belangrijke verstorende factor. Op 1 augustus verwerkte OpenCode volgens hetzelfde rapport 8 biljoen tokens voor dit model: 5 biljoen via gratis proefversies en 3 biljoen waarvoor ontwikkelaars betaalden. 5 Proefverkeer is commercieel relevant, want het verlaagt de drempel om een model te proberen. Maar het is iets anders dan stabiele, betaalde productiebelasting.
De stevigste conclusie is daarom dat V4 Flash uitzonderlijk snel werd verspreid en getest. Het beschikbare bewijs toont niet aan dat al dat vroege volume voortkwam uit betaalde migraties of duurzaam productiegebruik.
Tarieven verschillen per aanbieder, route, korting, cachestatus en meetmoment. In berichtgeving rond de release van 31 juli werd voor DeepSeek zelf $0,14 per miljoen niet-gecachete invoertokens en $0,28 per miljoen uitvoertokens genoemd. OpenRouter toonde begin augustus andere routetarieven. 3
De latere OpenRouter-vermelding voor de gedateerde route deepseek-v4-flash-0731 noemt $0,05 per miljoen invoertokens, $0,16 per miljoen uitvoertokens en $0,013 per miljoen cache-reads. 1
| Model | Vermeld tarief per 1 miljoen tokens (invoer / uitvoer) | Ten opzichte van V4-Flash: $0,05 / $0,16 |
|---|---|---|
| DeepSeek V4-Flash-0731 | $0,05 / $0,16 |
Referentie |
| Kimi K3 | $3 / $15 |
Circa 60× / 94× hoger |
| GPT-5.6 Sol | $5 / $30 |
Circa 100× / 188× hoger |
| Claude Fable 5 | $10 / $50 |
Circa 200× / 313× hoger |
Dit zijn rekenkundige vergelijkingen van gepubliceerde lijstprijzen. Ze bewijzen niet dat de modellen gelijkwaardig zijn in kwaliteit, snelheid, betrouwbaarheid van toolgebruik, veiligheidsinstellingen of beschikbaarheid. Ook leveren ze geen universele ‘kosten per taak’ op. De uiteindelijke rekening hangt onder meer af van invoer- en uitvoerlengte, caching, mislukte pogingen, toolcalls, providerkeuze en het aantal taken dat naar een sterker model moet worden doorgestuurd.
Deze modellen zijn niet onderling inwisselbaar, ook al richten ze zich alle vier op geavanceerd programmeerwerk en agents. De aangeleverde vergelijking beschrijft Kimi K3 als een MoE-model met 2,8 biljoen parameters en een contextvenster van 1 miljoen tokens. Voor GPT-5.6 Sol wordt 1,05 miljoen tokens context genoemd en voor Claude Fable 5 1 miljoen tokens. 17
Voor kopers is een praktische indeling zinvoller dan een ideologische:
Publieke benchmarks kunnen helpen om een shortlist te maken, maar één score bepaalt geen productiestandaard. De aangehaalde vergelijking van 25,2 tegenover 25,7 op ‘Agent Ultimate’ is niet onafhankelijk onderbouwd in de beschikbare bronnen en moet daarom niet als bewijs voor bijna-gelijke prestaties dienen. DeepSeek rapporteert zelf onder meer 82,7 op Terminal Bench 2.1 en 54,2 op NL2Repo, maar ook zulke scores vragen om validatie op de eigen werklast. 10
Voor een middelgroot ontwikkelteam is de kernvraag zelden: welk model wint een ranglijst? De relevante vraag is: welk model is betrouwbaar genoeg voor onze eigen taken en bespaart daarna voldoende geld, inclusief de kosten van fouten en doorsturen?
Een bruikbare evaluatie ziet er zo uit:
Daarom is de opmars van V4-Flash relevant, ook als proefverkeer de eerste tokenaantallen heeft opgeblazen. Een aggregator als OpenRouter geeft ontwikkelaars direct toegang tot een zeer goedkoop model met veel contextcapaciteit. Als het voldoende presteert in productie-evaluaties, kan het standaardvolume verschuiven van duurdere modellen naar deze route.
De beschikbare bronnen ondersteunen de OpenRouter-koppositie met 7,22 biljoen tokens, de overlap met de eerdere previewperiode en de gemelde rol van gratis proefverkeer op OpenCode. 3
5
Ze onderbouwen onvoldoende dat Chinese modellen negen van de tien hoogste posities innamen, dat zij veertien weken achtereen het Amerikaanse callvolume overtroffen, dat ontwikkelaars in de VS en Europa massaal migreerden, dat in de praktijk 60 tot 85 procent op inferentiekosten werd bespaard, of dat GPT-5.6 Luna door deze concurrentie een specifieke prijsverlaging van 80 procent doorvoerde.
Voor zulke claims zijn directe dashboardgegevens van OpenRouter, prijsinformatie van aanbieders of reproduceerbare studies naar concrete werklasten nodig. De onderbouwde conclusie is smaller, maar nog steeds belangrijk: DeepSeek V4-Flash bracht zeer lage vermelde routetarieven, een groot contextvenster en brede toegang samen op een moment dat ontwikkelaars goedkope modellen voor agents en programmeerwerk actief wilden testen. Dat is genoeg voor een snelle gebruikspiek — maar niet, op zichzelf, voor bewijs van een blijvende marktomwenteling.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeek V4 Flash stond in de week van 27 juli tot en met 2 augustus bovenaan de OpenRouter ranglijst met 7,22 biljoen verwerkte tokens, maar die periode begon vóór de officiële release van de 0731 versie.
DeepSeek V4 Flash stond in de week van 27 juli tot en met 2 augustus bovenaan de OpenRouter ranglijst met 7,22 biljoen verwerkte tokens, maar die periode begon vóór de officiële release van de 0731 versie. De routeprijs van V4 Flash 0731 op OpenRouter bedraagt $0,05 per miljoen invoertokens en $0,16 per miljoen uitvoertokens, met een contextvenster van 1.310.720 tokens.
Gratis proefverkeer speelde waarschijnlijk een grote rol: OpenCode verwerkte op 1 augustus 8 biljoen tokens voor het model, waarvan 5 biljoen via gratis proefversies.