DeepSeek erstattet flat per token pris med rushtidsprising 16. august 2026, noe som økte V4 Pro output prisen fra $0,87 til $3,96 per million tokens i rushtiden – en økning på 355 %.
Research answer

Create a landscape editorial hero image for this Studio Global article: What pricing changes did DeepSeek implement for its V4 API models on August 16, 2026, how does the new peak and off-peak tiered structure co. Article summary: **Pi Agent** led in both success rate (20/30) and cost efficiency ($0.028/task).. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence
Onsdag 16. august 2026 innførte DeepSeek en av de mest dramatiske prisendringene i KI-API-markedet ved å erstatte faste per-token-priser med en rushtids- og lavtrafikk-modell som presset kostnadene opp med hele 1.555 % for enkelte tokentyper . Samme uke avslørte det uavhengige testfirmaet Composio at DeepSeeks topprangerte V4 Flash-modell kun fullførte 53,8 % av virkelige agentoppgaver på tvers av åtte ulike orkestreringsrammeverk, noe som avdekker et betydelig gap mellom ledertavlescore og produksjonspålitelighet
. Til sammen tvinger disse utviklingene norske bedrifter til å revurdere totalkostnaden og orkestreringsmodenheten som kreves for å ta i bruk DeepSeek V4 i stor skala.
Fra klokken 16:00 UTC 16. august 2026 gikk DeepSeek fra én flat sats til en to-trinns prismodell for både V4-Flash og V4-Pro . Rushtid er 01:00–04:00 UTC og 06:00–10:00 UTC (7 timer totalt per døgn); alle andre timer er lavtrafikk
. Lavtrafikk-prisene er nøyaktig halvparten av rushtidsprisene, men hver eneste tokenkategori har likevel fått en netto økning sammenlignet med den tidligere faste prisen
.
| Modell | Tokentype | Tidligere flat pris | Lavtrafikk (ny) | Rushtid (ny) | Effektiv endring |
|---|---|---|---|---|---|
| V4-Flash | Input (cache miss) | $0,14 | $0,21 | $0,42 | +50 % lavtrafikk, +200 % rushtid |
| V4-Flash | Input (cache hit) | $0,0028 | $0,007 | $0,014 | +150 % lavtrafikk, +400 % rushtid |
| V4-Flash | Output | $0,28 | $0,42 | $0,84 | +50 % lavtrafikk, +200 % rushtid |
| V4-Pro | Input (cache miss) | $0,435 | $0,99 | $1,98 | +128 % lavtrafikk, +355 % rushtid |
| V4-Pro | Input (cache hit) | $0,003625 | $0,03 | $0,06 | +728 % lavtrafikk, +1.555 % rushtid |
| V4-Pro | Output | $0,87 | $1,98 | $3,96 | +128 % lavtrafikk, +355 % rushtid |
Kilde: DeepSeeks publiserte priskort og uavhengige sporinger .
Den mest ekstreme økningen er V4-Pro cache-hit input, som gikk fra $0,003625 til $0,06 i rushtiden – en økning på omtrent 1.555 % . DeepSeek opplyste at endringen ble gjort for å allokere ressurser mer effektivt og oppmuntre brukere til å planlegge ikke-hastende arbeid til lavtrafikk-tidsvinduer
.
I august 2026 evaluerte det uavhengige testfirmaet Composio DeepSeek V4 Flash på tvers av åtte ulike agentorkestreringsrammeverk på 30 bevisst vanskelige, flertrinns arbeidsflyter som spenner over levende verktøy som Gmail, GitHub, Slack og Google Sheets . Hver oppgave hadde en 900-sekunders tidsbegrensning, og alle rammeverkene brukte de samme vertede Composio MCP-verktøyene
.
Samlet resultat: Av totalt 240 kjøringer lyktes bare 129 – en total bestått-rate på 53,8 %. Bare 6 av de 30 arbeidsflytene ble fullført av samtlige rammeverk .
| Rammeverk | Bestått-rate (av 30 oppgaver) | Kostnad per vellykket oppgave |
|---|---|---|
| Pi Agent | 20/30 (66,7 %) | $0,028 |
| Prime Agent | ~15/24 (62,5 % gyldige kjøringer) | $0,131 |
| OMP (Oh My Pi) | 17/30 (56,7 %) | $0,103 |
| Claude Code | 16/30 (53,3 %) | $0,195 |
| Codex | 16/30 (53,3 %) | $0,081 |
| Deep Agents (LangChain) | 16/30 (53,3 %) | $0,045 |
| Hermes Agent | 15/30 (50,0 %) | $0,056 |
| OpenCode | 14/30 (46,7 %) | $0,067 |
Data fra Composios publiserte resultater .
Pi Agent ledet både i bestått-rate (20/30) og kostnadseffektivitet ($0,028/oppgave) . Ulike rammeverk vant på hver sin måling – bestått-rate, kostnad og hastighet – noe som betyr at valg av orkestreringsrammeverk er like viktig som modellens kapabilitet
. Forskjellen på 20 prosentpoeng mellom beste og dårligste rammeverk viser ekstrem følsomhet for agentrammeverket, verktøyoppsett, caching, gjenforsøk og leverandørvalg
.
Kombinasjonen av høyere priser og ujevne testresultater har endret analytikernes syn på DeepSeek V4s egnethet for bedrifter.
VentureBeat påpekte at den samme V4 Flash-modellen ga vesentlig forskjellige resultater avhengig av rammeverk, verktøy og caching-stack – noe som tyder på at bedrifter må investere i orkestreringsmodenhet parallelt med modellvalg . Composios egen kommentar påpekte at valget av rammeverk alene endret suksessraten med tre oppgaver, kostnaden med nesten 3 ganger og hastigheten med 2,2 ganger
.
Selv i lavtrafikk er alle tokentyper dyrere enn før. Analytikere sier dette endrer ROI-regnestykket for høyvolums agentarbeid, spesielt for kundestøtteagenter og kodegenereringspipelines som tidligere stolte på DeepSeeks aggressivt lave priser .
DeepSeeks offisielle agent-benchmarks (82,7 på Terminal-Bench 2.1, 70,3 på Toolathlon-Verified) ser sterke ut, men den reelle bestått-raten på 53,8 % er en påminnelse om at ledertavlescore ikke garanterer pålitelighet i produksjonsmiljøer med levende APIer, rate limits og stateful arbeidsflyter .
API-trafikk rutes via tjenere i Kina, noe som skaper etterlevelsesutfordringer for regulerte bedrifter. Analytikere anbefaler nøye arkitektonisk planlegging for datastyring, revisjonsspor og verktøytillatelser . For regulerte næringer er selv-hosting av de åpne vektene den eneste levedyktige veien til produksjon
.
BayTech Consultings bedriftsrammeverk anbefaler DeepSeek V4 for ikke-sensitive dokumentoppsummeringer, kodegenerering for åpne depoter og høyvolums innholdsutkast – men krever grundig evaluering av hver enkelt arbeidsmengde før produksjonssetting .
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeek erstattet flat per token pris med rushtidsprising 16. august 2026, noe som økte V4 Pro output prisen fra $0,87 til $3,96 per million tokens i rushtiden – en økning på 355 %.
DeepSeek erstattet flat per token pris med rushtidsprising 16. august 2026, noe som økte V4 Pro output prisen fra $0,87 til $3,96 per million tokens i rushtiden – en økning på 355 %. Uavhengig testing fra Composio viste at DeepSeek V4 Flash modellen kun fullførte 53,8 % av komplekse arbeidsflyter på tvers av åtte ulike agentrammeverk.
Forskjellen mellom beste og dårligste rammeverk var 20 prosentpoeng, noe som viser at orkestrering er like viktig som modellkraft for bedrifter.