Het ultra-goedkope model DeepSeek-V4-Flash-0731 trok uitzonderlijk veel gebruikers. Volgens ontwikkelaarsplatform OpenCode verwerkte V4 Flash op 1 augustus maar liefst 8 biljoen tokens op één dag . Die toestroom zette de beschikbare rekeninfrastructuur onder druk.
Daarnaast zou DeepSeek doordeweeks toeslagen tijdens piekuren willen invoeren: van 09.00 tot 12.00 uur en van 14.00 tot 18.00 uur volgens de tijd in Peking . Voor intensieve gebruikers en zakelijke toepassingen kan dat de uiteindelijke rekening verder opdrijven.
De prijswaarschuwing kwam enkele dagen nadat bekend werd dat DeepSeek een datacenter van ongeveer 1 gigawatt plant in Ulanqab, in de Chinese regio Binnen-Mongolië, circa 350 kilometer ten noordwesten van Peking . Een deel van het complex zou eind 2027 of begin 2028 operationeel kunnen zijn .
Nvidia-topman Jensen Huang schatte dat een datacenter van 1 gigawatt, uitgerust met de meest geavanceerde AI-versnellers, ongeveer 50 miljard dollar aan investeringen kan vergen . Dat is een indicatie van de mogelijke schaal van het project, geen door DeepSeek bevestigde begroting.
DeepSeek gebruikte zeer lage tarieven om snel marktaandeel en ontwikkelaars aan zich te binden. Die strategie werkte: het bedrijf bood prestaties op topniveau voor centen, terwijl Amerikaanse concurrenten voor vergelijkbare inference — het uitvoeren van een model om een antwoord te genereren — vaak dollars rekenden.
Maar zulke verlieslatende lokprijzen zijn moeilijk vol te houden wanneer het gebruik explodeert. De aangekondigde verhoging wordt daarom gezien als een omslag naar een model met meer duurzame inkomsten .
Onderstaande bedragen gelden per miljoen tokens en zijn gebaseerd op de tarieven van begin augustus 2026, dus vóór de aangekondigde verhoging . Een token is een klein tekstsegment dat een AI-model verwerkt. De rekening hangt af van zowel de ingevoerde tekst als de gegenereerde uitvoer.
| Aanbieder / model | Invoer per miljoen tokens | Uitvoer per miljoen tokens |
|---|---|---|
| DeepSeek V4 Flash | $0,14 | $0,28 |
| DeepSeek V4 Pro | $1,74 | $3,48 |
| Moonshot Kimi K3 | $3,00 | $15,00 |
| Moonshot Kimi K2.6 | $0,95 | $4,00 |
| Anthropic Claude Opus 4.8 | $5,00 | $25,00 |
| Anthropic Claude Sonnet 4.6 | $3,00 | $15,00 |
| Anthropic Fable 5 | ongeveer $3,00 | ongeveer $15,00 |
De API-verhoging staat niet op zichzelf. Ze valt samen met drie plannen die DeepSeek van een efficiënte modelbouwer veranderen in een veel kapitaalintensievere AI-onderneming.
DeepSeek wil in Ulanqab minstens 1 gigawatt aan rekenvermogen toevoegen. Het bedrijf zou een eigen faciliteit bouwen en daarnaast capaciteit huren bij andere aanbieders in de regio . Ulanqab beschikt al over tientallen datacenterprojecten. Goedkope elektriciteit en bijna tien maanden natuurlijke koeling per jaar maken de locatie aantrekkelijk .
Het plan markeert een duidelijke breuk met DeepSeeks eerdere imago als ‘efficiëntierebel’. Gehuurde of geleende clusters waren voldoende om de efficiëntie van de modellen te bewijzen. Om de concurrentie aan te gaan met veel beter gefinancierde Amerikaanse bedrijven is nu eigen infrastructuur op hyperscalerschaal nodig .
Op 6 augustus hervatte DeepSeek zijn tweede financieringsronde. Het bedrijf zou bijna 8 miljard dollar willen ophalen tegen een pre-moneywaardering van ongeveer 500 miljard yuan, omgerekend circa 74 miljard dollar .
De ronde was eind juli tijdelijk stilgelegd nadat uitgelekte opmerkingen van oprichter Liang Wenfeng sommige investeerders hadden gefrustreerd . Volgens berichtgeving zijn onder meer het nationale AI-fonds van China, NetEase, JD.com en IDG Capital bij het investeerderssyndicaat betrokken; Monolith Management zou mogelijk willen deelnemen .
Een duidelijker pad naar winstgevende API-inkomsten kan de financieringsronde aantrekkelijker maken. Hogere tarieven bieden immers meer zicht op de toekomstige omzet — al moet DeepSeek tegelijk voorkomen dat gebruikers massaal overstappen.
Reuters meldde op 15 juli dat DeepSeek de financieringsronde voorbereidt op een mogelijke beursgang op de STAR Market in Shanghai . Dit technologiegerichte Chinese beurssegment geldt als een mogelijke langetermijnuitstap voor investeerders.
Voor een beursgang zijn voorspelbare omzet en betere eenheidseconomie — de opbrengst en kosten per geleverde AI-dienst — belangrijk. De prijsverhoging past daarom bij een overgang van een start-up die vooral op groei mikt naar een onderneming die ook structureel inkomsten en rendement moet laten zien .
Dezelfde lage prijzen die DeepSeek groot maakten, kunnen nu een kwetsbaarheid worden. Ontwikkelaars kozen het platform juist omdat het veel goedkoper was dan alternatieven. Als het prijsvoordeel sterk afneemt, kunnen zij hun toepassingen over meerdere aanbieders verdelen of overstappen naar Moonshot, Anthropic of andere modellen .
Voor ontwikkelaars is het daarom verstandig om de nieuwe officiële tarieven af te wachten, kostenmodellen opnieuw door te rekenen en niet volledig afhankelijk te blijven van één API. Vooral toepassingen met grote hoeveelheden uitvoer, agenten die voortdurend modelaanroepen doen en zakelijke systemen die tijdens piekuren draaien, kunnen gevoelig zijn voor de wijziging.
DeepSeek probeert zo twee doelen tegelijk te bereiken: genoeg inkomsten genereren om een enorme infrastructuuruitbouw te betalen en zijn ontwikkelaarsbasis behouden. Of dat lukt, wordt een van de belangrijkste AI-verhalen van de rest van 2026 en 2027.