Priserne på DeepSeek V4 Flash og V4 Pro stiger med mellem 50 % og mere end 1.100 %, afhængigt af model, token type og tidspunkt. Peak priserne gælder kl.
Research answer

Create a landscape editorial hero image for this Studio Global article: How are DeepSeek’s August 2026 API price increases for V4-Flash and V4-Pro—including peak/off-peak rates, increases of 50% to more than 1,10. Article summary: DeepSeek is moving from a land-grab API strategy toward yield management and monetization, while OpenAI is using free consumer access to defend distribution and habit. They are not directly equivalent offers—developer AP. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
DeepSeeks API-ændring i august 2026 og OpenAIs udvidelse af gratis ChatGPT er to forskellige svar på det samme økonomiske problem: Hvordan tiltrækker man enorme mængder brug, samtidig med at udgifterne til modelkørsel bliver stadig højere?
DeepSeek bevæger sig væk fra sin strategi med ekstremt lave, faste API-priser. OpenAI bruger i stedet bred gratis adgang til at styrke sin forbrugerplatform. De to tiltag er ikke direkte sammenlignelige – det ene handler om udviklerinfrastruktur, det andet om en chattjeneste til forbrugere – men tilsammen viser de, at konkurrencen er ved at flytte sig.
Det handler ikke længere kun om, hvem der tilbyder den laveste tokenpris. Kampen står også om adgang, brugervaner, trafikstyring og en forretningsmodel, der kan finansiere den dyre AI-drift.
DeepSeeks nye prisstruktur trådte i kraft 16. august 2026 kl. 16.00 UTC. Virksomheden indførte separate peak- og off-peak-priser for V4-Flash og V4-Pro. Off-peak-priserne er halvdelen af peak-priserne. Peak-perioderne ligger kl. 01.00–04.00 UTC og 06.00–10.00 UTC; alle øvrige tidspunkter regnes som off-peak.
| Model | Periode | Input med cache-hit | Input uden cache-hit | Output |
|---|---|---|---|---|
| V4-Flash | Off-peak | $0,007 | $0,22 | $0,66 |
| V4-Flash | Peak | $0,014 | $0,44 | $1,32 |
| V4-Pro | Off-peak | $0,022 | $0,66 | $1,98 |
| V4-Pro | Peak | $0,044 | $1,32 | $3,96 |
Priserne er i amerikanske dollar pr. 1 million tokens. Cache-hit og cache-miss henviser til inputtokens.
Det er vigtigt, at “off-peak” ikke betyder, at alle priser er lavere end før. Den nye off-peak-pris for V4-Flash-output på 0,66 dollar ligger allerede over den tidligere pris på 0,28 dollar, mens V4-Pro-output stiger fra en kampagnepris på 0,87 dollar til 1,98 dollar i off-peak-perioder.
Stigningen varierer efter model, token-type og tidspunkt. Reuters rapporterede, at de nye priser ligger mellem 50 % og 1.100 % over de tidligere priser.
De største procentvise ændringer gælder cachede inputtokens, hvor udgangspunktet var meget lavt. For udviklere afhænger den praktiske effekt derfor især af forholdet mellem cache-hits, ikke-cachede input, genererede outputtokens og de tidspunkter, hvor systemet arbejder.
V4-Pro-output er eksempelvis cirka 128 % dyrere i off-peak-perioder end den tidligere kampagnepris på 0,87 dollar og cirka 355 % dyrere i peak-perioder, beregnet ud fra de oplyste priser.
DeepSeek er dog fortsat billig sammenlignet med mange lukkede amerikanske modeller, selv efter prisstigningen. Tidligere rapportering angav V4-Pro-output til omkring 0,87 dollar pr. million tokens under kampagneprisen, mens førende amerikanske systemer historisk har ligget væsentligt højere. Prisændringen svækker derfor DeepSeeks omkostningsfordel, men fjerner den ikke.
For en udvikler, der genererer 10 millioner V4-Pro-outputtokens om måneden, ser regnestykket sådan ud:
Det betyder, at den rene outputregning stiger med cirka 11,10–30,90 dollar om måneden, afhængigt af hvornår arbejdet udføres. Beregningen omfatter ikke inputtokens, cache-hit-gebyrer, skatter eller andre platformsomkostninger.
For en produktionsapplikation kan den største udfordring dog være sammensætningen af arbejdsbelastningen snarere end outputmængden alene. Et system med lange prompts, lav genbrug af cachede input eller trafik koncentreret i peak-perioder kan få en markant anderledes prisstigning.
Udviklere får derfor større incitament til at køre batchjobs uden for peak-perioderne og følge nøje med i andelen af cache-hits.
OpenAI har valgt en anden vej for ChatGPT. GPT-5.6 Luna blev standardmodellen for Free- og Go-brugere, samtidig med at OpenAI annoncerede ubegrænsede tekstchats og en ny Think-knap til vanskeligere spørgsmål.
Overskriften kræver dog en vigtig præcisering: Den ubegrænsede adgang gælder tekstchats, ikke alle ChatGPT-funktioner. Der er fortsat begrænsninger på filuploads, billeder, tale, billedgenerering og andre værktøjer, og tilbuddet er underlagt sikkerhedsforanstaltninger mod misbrug.
Det er en strategi for forbrugerdistribution – ikke en ændring af API-priserne. OpenAI reducerer friktionen ved daglig brug og sørger for, at en kompetent model ligger direkte i den almindelige ChatGPT-oplevelse. Ifølge TechCrunch havde ChatGPT for nylig passeret 1 milliard ugentlige brugere.
Lave tokenpriser har hjulpet kinesiske modeller med at tiltrække udviklere. En opgørelse fra Vercel AI Gateway viste, at open-weight-modeller udviklet i Kina stod for 29 % af de tokens, der blev behandlet i produktion i juni 2026 – op fra omtrent en niendedel i april – samtidig med at de stod for under 4 % af forbruget. Tallet beskriver trafikken på denne gateway og ikke hele det globale AI-marked.
Den forskel er afgørende. Tokenandel viser, hvor meget arbejde der går gennem et system, men siger ikke i sig selv noget om omsætning, overskud, kundeloyalitet eller varig markedsmagt. Udviklere kan flytte arbejdsbelastninger mellem leverandører, og prisfølsom trafik kan skifte hurtigt, når priserne ændres.
DeepSeeks nye prisplan tyder på, at det ikke længere er nok blot at vinde brugere. Tidsbaserede priser giver virksomheden mulighed for at fordele kapaciteten efter belastningen og tage mere, når efterspørgslen er koncentreret. Den officielle dokumentation beskriver ændringen som et middel til bedre ressourcefordeling og opfordrer brugerne til at planlægge opgaver efter det faktiske forbrug.
Ændringen kommer samtidig med, at andre kinesiske AI-virksomheder lancerer betalingsprodukter eller overvejer højere priser. Rapportering fra det bredere kinesiske marked har beskrevet, hvordan Moonshot AI og ByteDance har indført betalingsplaner, mens Alibaba forbereder sig på at følge efter. Det peger på et bredere skifte fra aggressiv subsidiering til indtjening.
Det beviser ikke, at DeepSeek eller konkurrenterne er profitable. Men det viser, at markedsandele opbygget gennem lave priser på et tidspunkt skal omsættes til indtjening pr. token, tilbagevendende kontrakter eller en anden bæredygtig forretningsmodel.
OpenAIs gratis Luna-udrulning handler først og fremmest om distribution – ikke om den lavest mulige API-regning. Ved at gøre tekstchat bredt tilgængelig og tilføje en synlig Think-knap forsøger OpenAI at gøre ChatGPT til en fast del af brugernes hverdag, mens de dyrere funktioner fortsat har strammere begrænsninger.
Den strategiske forskel er tydelig:
Strategierne kan godt eksistere side om side. En udvikler kan vælge DeepSeek til arbejdsbelastninger med stort volumen, mens en privatperson bruger ChatGPT til generel hjælp. Men begge virksomheder forsøger at gøre deres økosystemer sværere at erstatte: DeepSeek gennem forholdet mellem pris og ydeevne samt udviklernes trafikstyring, OpenAI gennem produktkendskab og rækkevidde blandt forbrugere.
DeepSeek er fortsat en billig løsning, men den nye V4-prisstruktur gør beskrivelsen “den billigste model” utilstrækkelig. Udviklere bør sammenligne den samlede regning på tværs af cache-hit-input, input uden cache-hit, outputmængde og koncentration af trafik i peak-perioder.
De praktiske spørgsmål er nu:
Det bredere AI-kapløb mellem Kina og USA handler derfor i mindre grad om, hvem der kan tilbyde den laveste overskriftspris. DeepSeek tester, om kinesiske AI-laboratorier kan omsætte et forspring i pris og ydeevne til en bæredygtig økonomi pr. enhed. OpenAI tester, om gratis og vanedannende adgang for forbrugere kan skabe varig kontrol over et økosystem.
I begge tilfælde er den centrale udfordring den samme: at omsætte enorme brugsmængder til en forretning, der kan fortsætte med at finansiere den enorme og tilbagevendende regning for avanceret modelberegning.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Priserne på DeepSeek V4 Flash og V4 Pro stiger med mellem 50 % og mere end 1.100 %, afhængigt af model, token type og tidspunkt.
Priserne på DeepSeek V4 Flash og V4 Pro stiger med mellem 50 % og mere end 1.100 %, afhængigt af model, token type og tidspunkt. Peak priserne gælder kl. 01.00–04.00 og 06.00–10.00 UTC og er dobbelt så høje som off peak priserne.
For 10 millioner månedlige V4 Pro outputtokens stiger regningen fra 8,70 dollar til 19,80 dollar ved udelukkende off peak brug eller 39,60 dollar ved peak brug.