| Tokentype | Huidige prijs | Nieuw dal | Nieuw piek |
|---|---|---|---|
| Input (cache miss) | $0,435 | ~$0,44–$0,49 (geschat) | ~$0,87–$0,98 (geschat) |
| Output | $0,87 | $1,98 | $3,96 |
| Tokentype | Huidige prijs | Nieuw dal | Nieuw piek |
|---|---|---|---|
| Input (cache miss) | $0,14 | ~$0,21 (geschat) | ~$0,42 (geschat) |
| Output | $0,28 | $0,63 | $1,26 |
(De prijzen voor input cache-miss bij de nieuwe tarieven zijn geschat op basis van de bevestigde output-vermenigvuldigers. De output-sprongen worden door meerdere bronnen bevestigd .)
Tokens uit de cache blijven dramatisch goedkoper. Voor V4-Pro blijft de input bij een cache-hit op ongeveer $0,004 per 1M tokens, een korting van 100x die ontwikkelaars stimuleert om hun cache-strategieën te optimaliseren .
Beide V4-modellen zijn tekstgebaseerd en gebruiken een Mixture-of-Experts (MoE)-architectuur, uitgebracht onder de MIT-licentie. Dit betekent dat ze volledig open-source zijn en door gebruikers zelf gehost kunnen worden .
| Specificatie | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| Totaal parameters | 1,6 biljoen | 284 miljard |
| Actieve parameters per token | ~49 miljard | ~13 miljard |
| Contextvenster | 1.000.000 tokens | 1.000.000 tokens |
| Maximale outputlengte | 384.000 tokens | 384.000 tokens |
| Licentie | MIT | MIT |
Beide modellen ondersteunen drie redeneermodi: Non-think (snel, intuïtief), Think High (logische analyse met stapsgewijze redenering) en Think Max (diepgaand redeneren) .
De nieuwe prijzen veranderen de concurrentiepositie van DeepSeek aanzienlijk. Onderstaande vergelijking gebruikt de standaard API-tarieven voor korte context per 1M tokens.
| Model | Input (per 1M) | Output (per 1M) |
|---|---|---|
| DeepSeek V4-Pro (piek) | ~$0,87–$0,98 | $3,96 |
| DeepSeek V4-Flash (piek) | ~$0,42 | $1,26 |
| OpenAI GPT-5.6 Luna | $0,20 | $1,20 |
| Anthropic Claude Fable 5 | $10,00 | $50,00 |
OpenAI verlaagde de prijzen van GPT-5.6 Luna op 30 juli 2026 met 80%, naar $0,20 voor input en $1,20 voor output per 1M tokens . Het concurrentiebeeld is daardoor compleet omgedraaid:
Waar DeepSeek ooit de duidelijke budgetoptie was, staat het nu tegenover een prijsleider in OpenAI's meest betaalbare laag .
Anthropics vlaggenschip redeneermodel kost $10 voor input en $50 voor output per 1M tokens . Tegen die prijzen blijft DeepSeek de voordeligere keuze:
Zelfs met de nieuwe, hogere tarieven blijven beide DeepSeek-modellen dramatisch goedkoper dan Anthropics topmodel .
De prijzen van xAI's Grok 4.6 waren niet beschikbaar in de verstrekte bronnen, dus een directe vergelijking is niet mogelijk.
DeepSeek noemde enorme vraag die de inferentiecapaciteit onder druk zet als de belangrijkste reden voor de verhoging . De V4-modellen werden massaal omarmd na hun preview-release in april 2026, wat leidde tot GPU-capaciteitsknelpunten die het bedrijf niet langer kon opvangen met de extreem lage prijzen
.
Verschillende marktkrachten kwamen samen:
DeepSeek's prijsverhogingen markeren het einde van het tijdperk waarin het veruit de goedkoopste API-aanbieder was voor geavanceerde AI-modellen. Het bedrijf beweegt zich nu naar een positie die op sommige punten dicht bij die van OpenAI's meest betaalbare model ligt, terwijl het Anthropics premium-tier nog steeds met een factor tien onderbiedt. Voor ontwikkelaars betekent de combinatie van piek-/daltarieven, diepe cache-kortingen en MIT-gelicentieerde open gewichten dat de architectuur van de werklast — en niet alleen de modelkeuze — steeds meer de uiteindelijke API-factuur zal bepalen.