Volgens de officiële DeepSeek API-documentatie wordt de API-prijs na afloop van de promotie permanent aangepast naar een kwart van het oorspronkelijke niveau, waardoor de gereduceerde prijs de nieuwe basis wordt.
Vóór de korting bedroeg de basisprijs ongeveer $1,74 per miljoen inputtokens en $3,48 per miljoen outputtokens. De huidige prijs is dus een blijvende stapverandering, geen marketingtruc.
De prijs van DeepSeek steekt schril af bij die van andere topmodellen.
OpenAI GPT‑5.5
Anthropic Claude Opus 4.7
DeepSeek V4‑Pro
Dat betekent:
Voor ontwikkelaars met hoge volumes – zoals code-assistenten, agents, documentanalysepijplijnen of klantondersteuningssystemen – zijn tokkenprijzen vaak de grootste kostenpost. Een verschil van deze orde kan bepalen welke architecturen economisch haalbaar zijn.
Naast de prijs concurreert V4‑Pro ook technisch met de beste modellen.
Belangrijke specificaties:
Het model is gebouwd met een Mixture-of-Experts (MoE)-architectuur met ongeveer 1,6 biljoen totale parameters en ongeveer 49 miljard actieve parameters per inferentiestap, wat hoge capaciteit mogelijk maakt zonder evenredig hogere rekenkosten.
Grote contextvensters zijn vooral nuttig voor:
In combinatie met extreem lage tokkenprijzen worden use cases mogelijk die met duurdere modellen onbetaalbaar zouden zijn.
Voor veel teams is inferentiekost – niet modelcapaciteit – de beperkende factor bij het opschalen van AI. Ultra-lage tokkenprijzen stellen ontwikkelaars in staat om:
In de praktijk kan het verschil tussen $0,87 en $25 per miljoen outputtokens van een experimentele workflow een economisch levensvatbaar product maken.
De strategie van DeepSeek weerspiegelt een grotere verschuiving in de AI-industrie.
Historisch gezien kostten topmodellen enkele dollars tot tientallen dollars per miljoen tokens, zoals bij GPT‑5.5 en Claude Opus 4.7.
DeepSeek kiest voor een volumegedreven prijsmodel en biedt dramatisch goedkopere inferentie terwijl de capaciteit concurrerend blijft. Analisten merken op dat DeepSeek herhaaldelijk prijzen van gevestigde aanbieders heeft onderboden met grote marges, wat helpt om de totale AI-kosten in de markt te drukken.
Deze aanpak doet denken aan dynamieken in cloud computing en GPU's: zodra een leverancier bewijst dat high-performance systemen veel goedkoper kunnen, wordt de hele markt gedwongen te reageren.
De prijsverlaging van DeepSeek roept verschillende strategische vragen op:
Wat nu al duidelijk is: tokkenprijzen – ooit beschouwd als een relatief stabiel onderdeel van de AI-stack – worden een concurrentiewapen. En als DeepSeek’s prijzen standhouden, kunnen de kosten voor het bouwen van grootschalige AI-systemen veel sneller dalen dan veel ontwikkelaars hadden verwacht.