DeepSeek ersatte den fasta taxa per token med topp och lågtrafikpriser den 16 augusti 2026, vilket ökade priset för V4 Pro output från 0,87 $ till 3,96 $ per miljon tokens under högtrafik – en ökning med 355 %. Oberoende tester från Composio visar att DeepSeek V4 Flash bara klarar 53,8 % av verkliga agentuppgifter,...
Research answer

Create a landscape editorial hero image for this Studio Global article: What pricing changes did DeepSeek implement for its V4 API models on August 16, 2026, how does the new peak and off-peak tiered structure co. Article summary: **Pi Agent** led in both success rate (20/30) and cost efficiency ($0.028/task).. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence
Den 16 augusti 2026 införde DeepSeek en av de mest omfattande prisförändringarna på AI-API-marknaden. Den tidigare fasta taxa per token ersattes med en topp- och lågtrafikstruktur som pressade upp kostnaderna med upp till 1 555 % för vissa tokentyper . Samma vecka avslöjade det oberoende testföretaget Composio att DeepSeeks topprankade V4 Flash-modell bara klarade 53,8 % av verkliga agentuppgifter över åtta olika orkestreringsramverk – ett tydligt tecken på klyftan mellan ledartavleresultat och verklig tillförlitlighet
. Tillsammans tvingar dessa händelser företag att ompröva den totala kostnaden och den orkestreringsmognad som krävs för att använda DeepSeek V4 i stor skala.
Från och med 16:00 UTC den 16 augusti 2026 bytte DeepSeek från en fast taxa till en tvådelad prismodell för både V4-Flash och V4-Pro . Högtrafik är 01:00–04:00 UTC och 06:00–10:00 UTC (totalt 7 timmar per dag); alla andra timmar är lågtrafik
. Lågtrafikpriserna är exakt hälften av högtrafikpriserna, men varje tokentyp har ändå blivit dyrare jämfört med den tidigare fasta taxan
.
| Modell | Tokentyp | Tidigare fast pris | Lågtrafik (nytt) | Högtrafik (nytt) | Effektiv förändring |
|---|---|---|---|---|---|
| V4-Flash | Input (cache miss) | 0,14 $ | 0,21 $ | 0,42 $ | +50 % lågtrafik, +200 % högtrafik |
| V4-Flash | Input (cache hit) | 0,0028 $ | 0,007 $ | 0,014 $ | +150 % lågtrafik, +400 % högtrafik |
| V4-Flash | Output | 0,28 $ | 0,42 $ | 0,84 $ | +50 % lågtrafik, +200 % högtrafik |
| V4-Pro | Input (cache miss) | 0,435 $ | 0,99 $ | 1,98 $ | +128 % lågtrafik, +355 % högtrafik |
| V4-Pro | Input (cache hit) | 0,003625 $ | 0,03 $ | 0,06 $ | +728 % lågtrafik, +1 555 % högtrafik |
| V4-Pro | Output | 0,87 $ | 1,98 $ | 3,96 $ | +128 % lågtrafik, +355 % högtrafik |
Källa: DeepSeeks publicerade prislista och oberoende spårare .
Den mest extrema ökningen gäller V4-Pro cache-hit input, som gick från 0,003625 $ till 0,06 $ under högtrafik – en ökning med cirka 1 555 % . DeepSeek motiverade förändringen med att resurserna ska fördelas mer effektivt och att användarna ska uppmuntras att schemalägga icke-brådskande arbetsbelastningar under lågtrafik
.
I augusti 2026 utvärderade det oberoende testföretaget Composio DeepSeek V4 Flash över åtta olika agentorkestreringsramverk på 30 avsiktligt svåra, flerstegsarbetsflöden som omfattade verktyg som Gmail, GitHub, Slack och Google Sheets . Varje uppgift hade en timeout på 900 sekunder, och alla ramverk använde samma värdbaserade Composio MCP-verktyg
.
Resultatet: av totalt 240 körningar lyckades bara 129 – en total genomslagsgrad på 53,8 %. Bara 6 av de 30 arbetsflödena slutfördes av alla ramverk .
| Ramverk | Genomslagsgrad (av 30 uppgifter) | Kostnad per lyckad uppgift |
|---|---|---|
| Pi Agent | 20/30 (66,7 %) | 0,028 $ |
| Prime Agent | ~15/24 (62,5 % giltiga körningar) | 0,131 $ |
| OMP (Oh My Pi) | 17/30 (56,7 %) | 0,103 $ |
| Claude Code | 16/30 (53,3 %) | 0,195 $ |
| Codex | 16/30 (53,3 %) | 0,081 $ |
| Deep Agents (LangChain) | 16/30 (53,3 %) | 0,045 $ |
| Hermes Agent | 15/30 (50,0 %) | 0,056 $ |
| OpenCode | 14/30 (46,7 %) | 0,067 $ |
Data från Composios publicerade resultat .
Pi Agent ledde i både genomslagsgrad (20/30) och kostnadseffektivitet (0,028 $/uppgift) . Olika ramverk vann på olika mätvärden – genomslagsgrad, kostnad och hastighet – vilket innebär att orkestreringsvalet är lika viktigt som modellens kapacitet
. Gapet på 20 procentenheter mellan bästa och sämsta ramverk visar en extrem känslighet för agentramverket, verktygskonfigurationen, cachning, återförsök och leverantörsstacken
.
Kombinationen av högre priser och ojämna verkliga resultat har förändrat analytikernas syn på DeepSeek V4:s lämplighet för företag.
VentureBeat noterade att samma V4 Flash-modell gav avsevärt olika resultat beroende på ramverk, verktyg och cachesystem – vilket tyder på att företag måste investera i orkestreringsmognad vid sidan av modellvalet . Composios egen kommentar påpekade att valet av ramverk ensamt förändrade genomslagsgraden med tre uppgifter, kostnaden med nästan 3x och hastigheten med 2,2x
.
Även under lågtrafik är varje tokentyp dyrare än tidigare. Analytiker menar att detta förändrar ROI-kalkylen för agentarbetsbelastningar med hög volym, särskilt för kundsupportagenter och pipeline för kodgenerering som tidigare förlitade sig på DeepSeeks aggressivt låga priser .
DeepSeeks officiella agentriktmärken (82,7 på Terminal-Bench 2.1, 70,3 på Toolathlon-Verified) ser starka ut, men den verkliga genomslagsgraden på 53,8 % är en påminnelse om att ledartavleresultat inte garanterar tillförlitlighet i produktionsmiljöer med levande API:er, hastighetsbegränsningar och tillståndskänsliga arbetsflöden .
API-trafik dirigeras via servrar i Kina, vilket skapar efterlevnadsutmaningar för reglerade företag. Analytiker rekommenderar noggrann arkitektonisk planering för datastyrning, revisionsspår och verktygsbehörighetskontroller . För reglerade branscher är egen hosting av de öppna vikterna den enda hållbara vägen till produktion
.
BayTech Consultings rekommendation för företag är att använda DeepSeek V4 för icke-känslig dokumentsammanfattning, kodgenerering på öppna databaser och innehållsutkast i hög volym – men att kräva noggrann utvärdering för varje arbetsbelastning innan man går till produktion .
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeek ersatte den fasta taxa per token med topp och lågtrafikpriser den 16 augusti 2026, vilket ökade priset för V4 Pro output från 0,87 $ till 3,96 $ per miljon tokens under högtrafik – en ökning med 355 %.
DeepSeek ersatte den fasta taxa per token med topp och lågtrafikpriser den 16 augusti 2026, vilket ökade priset för V4 Pro output från 0,87 $ till 3,96 $ per miljon tokens under högtrafik – en ökning med 355 %. Oberoende tester från Composio visar att DeepSeek V4 Flash bara klarar 53,8 % av verkliga agentuppgifter, oavsett vilket orkestreringsramverk som används.
Analytiker menar att företag måste investera i orkestrering och noggrant utvärdera arbetsbelastningar för att få lönsamhet med DeepSeek V4.