DeepSeek meldt grote verbeteringen ten opzichte van de april preview: Terminal Bench 2.1 stijgt van 72,1 naar 87,9, CyberGym van 52,7 naar 83,3 en DeepSWE van 12,8 naar 62,7. Met het open source DeepSeek Harness, uitgebracht onder de MIT licentie, begeeft het bedrijf zich naast model API’s ook op het terrein van ont...
Research answer

Create a landscape editorial hero image for this Studio Global article: What does DeepSeek’s move to general availability for its 1.6-trillion-parameter V4 Pro 0813 flagship model—released through the app’s Exper. Article summary: DeepSeek’s GA release appears to be a strategic pivot from a low-cost model vendor toward an integrated agent platform: a stronger flagship model, an open developer runtime, demand-shaping pricing, and capital-intensive . Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
De algemene beschikbaarheid van DeepSeek V4 Pro 0813 markeert een duidelijke koerswijziging. DeepSeek presenteert niet alleen een krachtiger vlaggenschipmodel, maar ook een open runtime voor agents, een prijsmodel dat vraag en capaciteit moet sturen en een infrastructuurplan dat groot genoeg is om langdurige groei te ondersteunen.
De meest indrukwekkende prestat cijfers zijn vooralsnog claims van DeepSeek zelf. De juiste conclusie is daarom niet dat het model zijn concurrenten definitief heeft verslagen, maar dat DeepSeek probeert te concurreren over de hele agent-stack: van model en API tot runtime, ontwikkelworkflow en rekeninfrastructuur.
DeepSeek zegt dat V4 Pro 0813 ten opzichte van de previewversie uit april sterk is verbeterd op evaluaties voor softwareontwikkeling en AI-agents:
De cijfers komen uit de door DeepSeek gepubliceerde vergelijkingstabel en zijn overgenomen in berichtgeving over de lancering. Op Terminal-Bench 2.1 ligt de gemelde score van 87,9 slechts 0,1 punt onder de 88,0 die in dezelfde vergelijking aan Anthropic’s Fable 5 wordt toegeschreven.
Dat zou V4 Pro 0813 dicht bij de voorhoede plaatsen voor taken die kenmerkend zijn voor programmeeragents: door codebases navigeren, tools gebruiken, opdrachten uitvoeren en softwarewerk in meerdere stappen afronden.
Daarbij hoort wel een belangrijke kanttekening. De scores zijn door de leverancier gerapporteerd en er is geen onafhankelijke bevestiging beschikbaar op basis van één gemeenschappelijke evaluatieomgeving. Een sprong op DeepSWE van 12,8 naar 62,7 is opvallend, maar bewijst op zichzelf niet dat de betrouwbaarheid in echte productieomgevingen vergelijkbaar is met die van concurrenten.
Strategisch gezien kan de lancering van DeepSeek Harness nog belangrijker zijn dan de modelupdate. Dit open-source agent-runtime is uitgebracht onder de MIT-licentie. Het vormt de laag tussen een taalmodel en de ontwikkelomgeving van de gebruiker en coördineert tools, bestanden, opdrachten, sessies en workflows met meerdere stappen. In de repository omschrijft DeepSeek het project als een open-source agent-harness en maakt het bedrijf de licenties van externe afhankelijkheden bekend.
Daarmee verschuift ook het speelveld. DeepSeek concurreert niet langer alleen om API-aanroepen met andere modelaanbieders. Met Harness begeeft het zich bovendien op de workflowlaag waarop ontwikkelaars bepalen hoe agents werken, welke tools ze mogen gebruiken en hoeveel controle zij over de runtime houden. Dat is het terrein waarop producten als Claude Code en Codex actief zijn.
Het project kreeg uitzonderlijk snel aandacht. Volgens externe tracking waren er ongeveer een uur na de lancering al meer dan 20.000 GitHub-sterren en stond de teller op 17 augustus boven de 141.000. Dat wijst op grote nieuwsgierigheid onder ontwikkelaars, maar GitHub-sterren zijn niet hetzelfde als productiegebruik, terugkerende gebruikers of veilige bedrijfsintegraties.
Voorzichtigheid blijft daarom geboden. Harness v0.1 is een ontwikkelaars-preview en volgens berichtgeving zijn wijzigingen te verwachten die de compatibiliteit kunnen verbreken. Een architectuur die sterk op plugins leunt, maakt een agent flexibel en aanpasbaar, maar kan ook de operationele complexiteit verhogen. Iedere extra tool of plugin roept vragen op over rechten, onderhoud, foutafhandeling en toegang tot gegevens.
Ook kunnen workflows met meerdere stappen en uitgebreide toolbeschrijvingen het tokengebruik verhogen. Daardoor zegt de prijs per token minder over de uiteindelijke kosten van een volledig autonome workflow. Meer dan 2.000 pluginvoorstellen wijzen op interesse in een ecosysteem, maar nog niet op een volwassen of betrouwbaar pluginplatform.
Ontwikkelaars doen er daarom goed aan plugins in afgeschermde omgevingen te testen, rechten zorgvuldig te controleren en de totale kosten per afgeronde taak te meten. Alleen naar de activiteit van de repository kijken is onvoldoende.
De prijswijziging van DeepSeek is belangrijk omdat het bedrijf afstapt van een eenvoudig vast tarief en overstapt op tijdsafhankelijke facturering. In de aankondiging werden piekuren gekoppeld aan de tijd in Beijing, terwijl latere prijsoverzichten overeenkomstige UTC-vensters vermeldden. Omdat de gepubliceerde schema’s niet in alle berichtgeving hetzelfde worden weergegeven, moeten ontwikkelaars de actuele tijden controleren in de officiële prijsdocumentatie van DeepSeek.
De richting van de prijswijziging is duidelijker dan het precieze tijdschema. Volgens berichtgeving stijgt de prijs voor uitvoertokens van V4 Pro van $0,87 per miljoen naar $1,98 buiten piekuren en $3,96 tijdens piekuren. Voor sommige categorieën binnen de V4-familie liepen de verhogingen, afhankelijk van model, tokentype en factureringsperiode, op tot meer dan 1.100 procent.
Voor ontwikkelaars heeft dat enkele directe gevolgen:
Dit is dus meer dan alleen een beslissing over inkomsten. Piekprijzen kunnen ook dienen als instrument om capaciteit te beheren: flexibele workloads worden aangemoedigd om buiten de drukste uren te draaien. Dat suggereert dat DeepSeek inferentie steeds meer behandelt als een schaarse infrastructuurbron, in plaats van lage prijzen als belangrijkste groeimotor te blijven gebruiken.
Zelfs bij $3,96 per miljoen uitvoertokens blijft V4 Pro aanzienlijk goedkoper dan de $50 per miljoen uitvoertokens die in berichtgeving over Fable 5 als vergelijking wordt genoemd. Voor grote volumes aan programmeer- en agenttaken houdt DeepSeek daarmee een betekenisvol prijsvoordeel.
De economie is alleen niet meer hetzelfde als “bijna gratis”. Een stijging van 355 procent ten opzichte van het eerdere tarief van $0,87 verandert de berekening voor productiesystemen die grote hoeveelheden uitvoer genereren. Teams moeten daarom kijken naar de kosten van een succesvolle taak, inclusief retries, toolaanroepen, context en wachttijd, en niet alleen naar de geadverteerde prijs per miljoen tokens.
De waardepropositie wordt daarmee conventioneler: DeepSeek kan nog altijd een sterke verhouding tussen prijs en capaciteit bieden, maar vraagt klanten steeds nadrukkelijker te betalen voor premiumcapaciteit en hun workloads af te stemmen op de beschikbare rekenkracht.
De bredere strategie sluit aan bij de gemelde financiering en infrastructuurplannen van DeepSeek. Reuters meldde dat het bedrijf in zijn eerste financieringsronde meer dan 50 miljard yuan, omgerekend ongeveer $7,4 miljard, heeft opgehaald. Bloomberg meldde afzonderlijk plannen voor een datacenterproject in Ulanqab in Binnen-Mongolië, met de beoogde toevoeging van ongeveer één gigawatt aan rekenvermogen.
Deze berichten bewijzen niet dat ieder onderdeel van de strategie zal slagen of dat de geplande faciliteit op tijd wordt opgeleverd. Ze wijzen wel op een kapitaalintensiever bedrijfsmodel. De combinatie van modelverbeteringen, een open runtime, gedifferentieerde prijzen, externe financiering en geplande rekeninfrastructuur past bij vier samenhangende doelen:
Dat is een andere positionering dan vooral proberen de goedkoopste capabele modelaanbieder te zijn.
DeepSeek V4 Pro 0813 is het testen waard, vooral voor programmeren, automatisering rond code-repositories en workflows waarin tools worden gebruikt. Organisaties zouden vooraf wel vier zaken zelfstandig moeten controleren:
De sterkste interpretatie van deze release is daarom strategisch en niet uitsluitend numeriek. DeepSeek probeert zich te ontwikkelen van een goedkope modelleverancier tot een geïntegreerd agentplatform. V4 Pro 0813 levert de prestatieclaim, Harness het ontwikkelaarsoppervlak, piekprijzen de vraagsturing en nieuwe financiering plus geplande rekenkracht het infrastructuurverhaal.
Of dat uitgroeit tot een blijvend voordeel, hangt af van onafhankelijke benchmarkresultaten, stabiele software, veilige plugins en de vraag of ontwikkelaars na de prijsverhogingen nog voldoende waarde ervaren.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeek meldt grote verbeteringen ten opzichte van de april preview: Terminal Bench 2.1 stijgt van 72,1 naar 87,9, CyberGym van 52,7 naar 83,3 en DeepSWE van 12,8 naar 62,7.
DeepSeek meldt grote verbeteringen ten opzichte van de april preview: Terminal Bench 2.1 stijgt van 72,1 naar 87,9, CyberGym van 52,7 naar 83,3 en DeepSWE van 12,8 naar 62,7. Met het open source DeepSeek Harness, uitgebracht onder de MIT licentie, begeeft het bedrijf zich naast model API’s ook op het terrein van ontwikkeltools en agent workflows.
De nieuwe piek en dalprijzen verhogen de kosten voor V4 Pro uitvoer van $0,87 naar $1,98 per miljoen tokens buiten piekuren en $3,96 tijdens piekuren.