| Tokentype | Nuværende pris | Ny lavlast | Ny spidsbelastning |
|---|---|---|---|
| Input (cache miss) | $0,435 | ~$0,44–$0,49 (est.) | ~$0,87–$0,98 (est.) |
| Output | $0,87 | $1,98 | $3,96 |
| Tokentype | Nuværende pris | Ny lavlast | Ny spidsbelastning |
|---|---|---|---|
| Input (cache miss) | $0,14 | ~$0,21 (est.) | ~$0,42 (est.) |
| Output | $0,28 | $0,63 | $1,26 |
(Input cache-miss-priser for de nye takster er estimeret ud fra de bekræftede output-multiplikatorer. Output-stigninger er bekræftet af flere kilder .)
Cached input-tokens forbliver dramatisk billigere. For V4-Pro koster cache-hit input cirka $0,004 pr. 1M tokens – en 100x rabat, der tilskynder udviklere til at optimere deres caching-strategier .
Begge V4-modeller er tekstbaserede Mixture-of-Experts (MoE)-arkitekturer udgivet under MIT-licens, hvilket gør dem fuldt open-weight og selv-hostbare .
| Specifikation | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| Samlede parametre | 1,6 billioner | 284 milliarder |
| Aktive parametre pr. token | ~49 milliarder | ~13 milliarder |
| Kontekstvindue | 1.000.000 tokens | 1.000.000 tokens |
| Maks. outputlængde | 384.000 tokens | 384.000 tokens |
| Licens | MIT | MIT |
Begge modeller understøtter tre ræsonnement-tilstande: Non-think (hurtig, intuitiv), Think High (logisk analyse med tankekæde) og Think Max (dybdegående ræsonnement) .
De nye priser ændrer DeepSeek's konkurrenceposition. Sammenligningen nedenfor bruger standard kortkontekst API-satser pr. 1M tokens for alle udbydere.
| Model | Input (pr. 1M) | Output (pr. 1M) |
|---|---|---|
| DeepSeek V4-Pro (spids) | ~$0,87–$0,98 | $3,96 |
| DeepSeek V4-Flash (spids) | ~$0,42 | $1,26 |
| OpenAI GPT-5.6 Luna | $0,20 | $1,20 |
| Anthropic Claude Fable 5 | $10,00 | $50,00 |
OpenAI skar GPT-5.6 Luna-priserne med 80 % den 30. juli 2026 til $0,20 input og $1,20 output pr. 1M tokens . Det konkurrencebillede er vendt på hovedet:
Hvor DeepSeek engang var det indlysende budgetvalg, står det nu over for en prisfører i OpenAIs mest overkommelige lag .
Anthropics flagskibs-ræsonnementmodel koster $10 input og $50 output pr. 1M tokens . På de niveauer er DeepSeek stadig et godt køb:
Selv med deres nye, højere satser er begge DeepSeek-modeller stadig dramatisk billigere end Anthropics topmodel .
xAI's Grok 4.6-priser var ikke tilgængelige fra de medfølgende kilder, så en direkte sammenligning kan ikke foretages.
DeepSeek angav voldsom efterspørgsel, der belaster inferenskapaciteten, som den primære årsag til stigningen . V4-modellerne opnåede massiv adoption efter deres preview-lancering i april 2026, hvilket skabte GPU-kapacitetsflaskehalse, som selskabet ikke længere kunne absorbere til sine tidligere ekstremt lave priser
.
Flere markedskræfter konvergerede:
DeepSeeks prisstigninger markerer afslutningen på en æra, hvor de var den suverænt billigste frontløber-API-udbyder. Selskabet er nu tættere på at være på niveau med OpenAIs mest overkommelige model på nogle dimensioner, mens de stadig underbyder Anthropics premium-lag med en størrelsesorden. For udviklere betyder kombinationen af spids-/lavlastpriser, dybe caching-rabatter og MIT-licenserede open-weights, at arbejdsbelastningsarkitekturen – snarere end det rå modelvalg – i stigende grad vil bestemme den endelige API-regning.