De verhoging verschilt per model, token-type en tijdstip. Volgens Reuters liggen de nieuwe tarieven 50% tot 1.100% boven de eerdere prijzen.
De grootste procentuele sprongen zijn zichtbaar bij invoer die uit de cache komt, omdat die eerder zeer goedkoop was. Voor ontwikkelaars hangt de praktische impact vooral af van de verhouding tussen cache-hits, niet-gecachete invoer, gegenereerde uitvoer en het moment waarop workloads draaien.
V4-Pro-uitvoer kost bijvoorbeeld in de daluren ongeveer 128% meer dan de eerdere promotieprijs van $0.87. Tijdens piekuren ligt de prijs ongeveer 355% hoger.
Ook na de verhoging blijft DeepSeek relatief goedkoop vergeleken met veel gesloten Amerikaanse modellen. Eerdere berichtgeving zette de promotieprijs voor V4-Pro-uitvoer op ongeveer $0.87 per miljoen tokens, tegenover aanzienlijk hogere historische tarieven voor toonaangevende Amerikaanse systemen. DeepSeek verliest dus een deel van zijn kostenvoordeel, maar raakt het niet volledig kwijt.
Voor een ontwikkelaar die maandelijks 10 miljoen V4-Pro-uitvoertokens genereert, ziet de rekening er — exclusief invoertokens en overige kosten — als volgt uit:
De rekening voor alleen de uitvoer stijgt daarmee met ongeveer $11.10 tot $30.90 per maand, afhankelijk van de timing. Invoer, cachekosten, belastingen en andere platformkosten zijn niet meegerekend.
Voor een productieapplicatie kan de samenstelling van het verkeer belangrijker zijn dan de uitvoer alleen. Een systeem met lange prompts, weinig hergebruik van de cache of veel verkeer tijdens piekuren kan een veel grotere stijging zien. Batchverwerkingen buiten de piekuren plannen en het aandeel cache-hits volgen, wordt daardoor belangrijker.
OpenAI kondigde ondertussen een heel andere wijziging aan voor ChatGPT. GPT-5.6 Luna wordt het standaardmodel voor gebruikers van de Free- en Go-abonnementen. Daarnaast maakt OpenAI onbeperkte tekstchats mogelijk en introduceert het een nieuwe Think-knop voor moeilijkere vragen.
Daarbij is een belangrijke kanttekening nodig: ‘onbeperkt’ geldt voor tekstchats, niet voor alle functies van ChatGPT. Voor bestandsuploads, afbeeldingen, spraak, beeldgeneratie en andere hulpmiddelen blijven limieten gelden. Ook blijft de toegang onderworpen aan maatregelen tegen misbruik.
Dit is geen antwoord op DeepSeeks API-prijsstrategie, maar een strategie voor consumentenbereik. OpenAI verlaagt de drempel voor dagelijks gebruik en houdt een capabel model centraal in de standaardervaring van ChatGPT. Volgens TechCrunch had ChatGPT kort daarvoor de grens van 1 miljard wekelijkse gebruikers overschreden.
Goedkope tokens hebben Chinese modellen geholpen om snel gebruik onder ontwikkelaars op te bouwen. Een meting van Vercel AI Gateway liet zien dat in juni 2026 29% van de productietokens via Chinees ontwikkelde open-weight-modellen liep, tegenover ongeveer een negende in april. De cijfers hebben betrekking op het verkeer via die gateway, niet op de volledige wereldwijde AI-markt.
Dat onderscheid is belangrijk. Het aandeel in tokens zegt hoeveel werk door een systeem stroomt, maar bewijst op zichzelf niets over omzet, winst, klantentrouw of blijvende marktmacht. Ontwikkelaars kunnen workloads tussen aanbieders verplaatsen en prijsgevoelig verkeer kan snel verschuiven zodra tarieven veranderen.
De nieuwe tariefstructuur suggereert dat gebruik winnen niet langer het enige doel is. Met tijdsgebonden prijzen kan DeepSeek capaciteit beter verdelen en meer rekenen wanneer de vraag zich op bepaalde momenten ophoopt. In de officiële documentatie omschrijft het bedrijf de wijziging als een manier om middelen efficiënter toe te wijzen en moedigt het gebruikers aan taken op basis van hun werkelijke gebruik te plannen.
De wijziging komt bovendien op een moment waarop ook andere Chinese AI-bedrijven betaalde diensten aanbieden of hogere prijzen overwegen. Berichtgeving over de bredere Chinese markt noemt betaalde plannen van Moonshot AI en ByteDance, terwijl Alibaba zou willen volgen. Dat wijst op een verschuiving van agressieve subsidiëring naar monetisatie.
Daarmee is nog niet bewezen dat DeepSeek of zijn concurrenten winstgevend zijn. Wel wordt duidelijk dat marktaandeel dat met lage prijzen is opgebouwd uiteindelijk moet worden omgezet in omzet per token, terugkerende contracten of een ander duurzaam verdienmodel.
De gratis uitrol van Luna draait vooral om distributie, niet om de allerlaagste API-rekening. Door tekstchats breed beschikbaar te maken en een zichtbare Think-knop toe te voegen, probeert OpenAI van ChatGPT een vaste gewoonte te maken. Tegelijk houdt het bedrijf strakkere limieten op duurdere functies.
De strategische tegenstelling is duidelijk:
De twee strategieën kunnen naast elkaar bestaan. Een ontwikkelaar kan DeepSeek kiezen voor grootschalige workloads, terwijl een consument ChatGPT gebruikt voor algemene hulp. Beide bedrijven proberen hun ecosysteem wel moeilijker vervangbaar te maken: DeepSeek via prijs-prestatie en ontwikkelaarsroutering, OpenAI via productbekendheid en consumentenbereik.
DeepSeek blijft een goedkope optie, maar ‘het goedkoopste model’ is voortaan een te simpele omschrijving. Ontwikkelaars moeten de totale rekening vergelijken op basis van cache-hits, niet-gecachete invoer, uitvoervolume en de hoeveelheid verkeer tijdens piekuren.
De belangrijkste vragen zijn nu:
De AI-concurrentie tussen China en de Verenigde Staten gaat daardoor minder over de vraag wie de laagste prijs kan afficheren. DeepSeek test of Chinese AI-labs hun voorsprong in kosten en prestaties kunnen omzetten in duurzame bedrijfseconomie. OpenAI test of gratis, veelvuldig consumentengebruik kan uitgroeien tot blijvende controle over een ecosysteem.
In beide gevallen ligt dezelfde uitdaging op tafel: enorme gebruiksvolumes omzetten in een bedrijf dat de voortdurende kosten van rekenkracht voor geavanceerde modellen kan blijven financieren.