Modellen använder en hybrid uppmärksamhetsmekanism som kombinerar komprimerad sparse attention med nya högkomprimerade uppmärksamhetshuvuden för kostnadseffektiv ifyllnad av långa kontexter.
Den viktigaste förbättringen i den nya versionen gäller agentförmågan. I en officiell grupp publicerade DeepSeek ett diagram med jämförande testdata som visar att den nya modellens agentprestanda närmar sig – och i vissa fall till och med överträffar – Anthropics Claude Fable 5.
Dessutom har V4 Pro officiella version lagt till stöd för Responses API och Codex-integration, vilket ytterligare stärker dess roll som utvecklingsverktyg.
API-priset för DeepSeek V4 Pro har tills vidare inte höjts och ligger kvar på den nivå som sattes efter prissänkningen i maj. Prissättningen är följande:
| Avgiftstyp | Pris (yuan per miljon tokens) |
|---|---|
| Inmatning (cachad) | 0,025 |
| Inmatning (ej cachad) | 3 |
| Utmatning | 6 |
För jämförelse: den lättviktsversion som kallas V4 Flash har motsvarande priser på 0,02 yuan, 1 yuan respektive 2 yuan. V4 Pro är alltså tre gånger dyrare än V4 Flash för utmatning och ej cachad inmatning.
DeepSeeks prissättning är extremt konkurrenskraftig. Enligt rapporter presterar V4 Pro nära Fable 5 men kostar endast cirka 2 procent av priset. Däremot har DeepSeek redan meddelat på sin webbplats att API-priserna sannolikt kommer att höjas rejält inom en snar framtid.
Det är viktigt att påpeka att de testdata som finns tillgängliga för V4 Pro officiella version huvudsakligen kommer från en jämförelsetabell som läckte från DeepSeeks officiella grupp. Oberoende tredjepartstester i större skala har ännu inte genomförts. Slutsatser om att modellen ”närmar sig” eller ”överträffar” andra modeller bör därför tolkas med viss försiktighet.
DeepSeek har hittills inte publicerat någon officiell changelog eller teknisk blogg som beskriver de specifika förbättringarna eller prestandadata för V4 Pro officiella version.
Lanseringen av DeepSeek V4 Pro officiella version, om än i det tysta, visar på kraftiga framsteg inom agentförmåga samtidigt som priset förblir ytterst konkurrenskraftigt. Även om officiell information är begränsad placerar de data som finns modellen bland de främsta globala AI-modellerna. För utvecklare och företag innebär det ett nytt, kraftfullt och kostnadseffektivt alternativ.