| Tokentyp | Nuvarande pris | Nytt lågpris | Nytt toppris |
|---|---|---|---|
| Input (cache miss) | 0,435 USD | ~0,44–0,49 USD (uppsk.) | ~0,87–0,98 USD (uppsk.) |
| Output | 0,87 USD | 1,98 USD | 3,96 USD |
| Tokentyp | Nuvarande pris | Nytt lågpris | Nytt toppris |
|---|---|---|---|
| Input (cache miss) | 0,14 USD | ~0,21 USD (uppsk.) | ~0,42 USD (uppsk.) |
| Output | 0,28 USD | 0,63 USD | 1,26 USD |
(Priserna för input cache miss vid nya nivåer är uppskattade utifrån de bekräftade multiplikatorerna för output. Ökningarna för output är bekräftade av flera källor .)
Cachade input-tokens förblir dramatiskt billigare. För V4-Pro ligger cache-hit input kvar på cirka 0,004 USD per 1M tokens, en 100x rabatt som uppmuntrar utvecklare att optimera sina cachningsstrategier .
Båda V4-modellerna är textbaserade, använder en Mixture-of-Experts (MoE)-arkitektur och är släppta under MIT-licens, vilket gör dem helt öppna och möjliga att köra på egen hårdvara .
| Specifikation | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| Totala parametrar | 1,6 biljoner | 284 miljarder |
| Aktiva parametrar per token | ~49 miljarder | ~13 miljarder |
| Kontextfönster | 1 000 000 tokens | 1 000 000 tokens |
| Maximal utgångslängd | 384 000 tokens | 384 000 tokens |
| Licens | MIT | MIT |
Båda modellerna har tre lägen för resonemang: Non-think (snabb, intuitiv), Think High (logisk analys med kedja av tankar) och Think Max (djup resonemang) .
De nya priserna förändrar DeepSeeks konkurrensposition. Jämförelsen nedan baseras på standard API-priser per 1M tokens för alla leverantörer.
| Modell | Input (per 1M) | Output (per 1M) |
|---|---|---|
| DeepSeek V4-Pro (topp) | ~0,87–0,98 USD | 3,96 USD |
| DeepSeek V4-Flash (topp) | ~0,42 USD | 1,26 USD |
| OpenAI GPT-5.6 Luna | 0,20 USD | 1,20 USD |
| Anthropic Claude Fable 5 | 10,00 USD | 50,00 USD |
OpenAI sänkte priserna på GPT-5.6 Luna med 80 % den 30 juli 2026, till 0,20 USD input och 1,20 USD output per 1M tokens . Konkurrensbilden förändrades dramatiskt:
Där DeepSeek en gång var det självklara budgetalternativet, möter man nu en prissättningsledare i OpenAIs mest prisvärda nivå .
Anthropics flaggskeppsmodell för resonemang är prissatt till 10 USD input och 50 USD output per 1M tokens . På dessa nivåer är DeepSeek fortfarande ett prisvärt alternativ:
Även med de nya högre priserna är båda DeepSeek-modellerna dramatiskt billigare än Anthropics premiumnivå .
Priserna för xAI:s Grok 4.6 var inte tillgängliga i de angivna källorna, så en direkt jämförelse kan inte göras.
DeepSeek hänvisade till en enorm efterfrågan som anstränger inferenskapaciteten som den främsta orsaken till höjningen . V4-modellerna fick en massiv användning efter lanseringen av förhandsversionen i april 2026, vilket skapade GPU-kapacitetsflaskhalsar som företaget inte längre kunde absorbera med sina tidigare extremt låga priser
.
Flera marknadskrafter samverkade:
DeepSeek prisökningar markerar slutet på eran som den överlägset billigaste API-leverantören inom frontlinjen. Företaget ligger nu närmare OpenAI:s mest prisvärda modell på vissa områden, samtidigt som det fortfarande underbjuder Anthropics premiumnivå med en tiopotens. För utvecklare innebär kombinationen av topp-/lågprisnivåer, djupa cachningsrabatter och MIT-licensierade öppna vikter att arbetsbelastningens arkitektur – snarare än valet av modell i sig – alltmer kommer att avgöra den slutliga API-fakturan.