DeepSeeks priser för V4 Flash och V4 Pro ökar med mellan 50 och över 1 100 procent, beroende på modell, token typ och tid på dygnet. De nya toppnivåerna gäller under 01.00–04.00 och 06.00–10.00 UTC.
Research answer

Create a landscape editorial hero image for this Studio Global article: How are DeepSeek’s August 2026 API price increases for V4-Flash and V4-Pro—including peak/off-peak rates, increases of 50% to more than 1,10. Article summary: DeepSeek is moving from a land-grab API strategy toward yield management and monetization, while OpenAI is using free consumer access to defend distribution and habit. They are not directly equivalent offers—developer AP. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
DeepSeeks prisändring i augusti 2026 och OpenAI:s utökade gratisversion av ChatGPT är två olika svar på samma ekonomiska problem: hur AI-företag ska hantera enorm efterfrågan när kostnaden för att köra modellerna fortsätter att öka.
DeepSeek lämnar sin tidigare strategi med extremt låga och enhetliga API-priser. OpenAI satsar i stället på bred gratis tillgång för att stärka ChatGPT:s plats i vardagen. Det handlar inte om jämförbara produkter – det ena är utvecklarinfrastruktur och det andra en konsumenttjänst – men tillsammans visar förändringarna att AI-kampen inte längre bara avgörs av vem som erbjuder lägst tokenpris. Tillgång, användarvanor, trafikstyrning och hållbara intäkter blir allt viktigare.
DeepSeeks nya prislista började gälla den 16 augusti 2026 klockan 16.00 UTC. För V4-Flash och V4-Pro inför företaget separata priser för hög- och lågtrafik. Lågtrafik kostar hälften så mycket som högtrafik. Högtrafik infaller mellan 01.00 och 04.00 UTC samt mellan 06.00 och 10.00 UTC; övriga timmar räknas som lågtrafik.
| Modell | Period | Inmatning med cacheträff | Inmatning utan cacheträff | Utdata |
|---|---|---|---|---|
| V4-Flash | Lågtrafik | 0,007 USD | 0,22 USD | 0,66 USD |
| V4-Flash | Högtrafik | 0,014 USD | 0,44 USD | 1,32 USD |
| V4-Pro | Lågtrafik | 0,022 USD | 0,66 USD | 1,98 USD |
| V4-Pro | Högtrafik | 0,044 USD | 1,32 USD | 3,96 USD |
Priserna anges i amerikanska dollar per 1 miljon token. Cacheträff och cachemiss gäller inmatningstoken.
Att en period kallas ”lågtrafik” betyder alltså inte att den är billigare än tidigare. Den nya lågtrafikavgiften för utdata från V4-Flash är 0,66 dollar, jämfört med tidigare 0,28 dollar. För V4-Pro stiger utdata från det tidigare kampanjpriset på 0,87 dollar till 1,98 dollar även under lågtrafik.
Ökningen varierar beroende på modell, token-typ och när tjänsten används. Reuters rapporterade att de nya priserna ligger mellan 50 och 1 100 procent över de tidigare nivåerna.
De största procentuella förändringarna gäller cachad indata, där utgångspriset var mycket lågt. För utvecklare beror den faktiska kostnadseffekten därför på fördelningen mellan cacheträffar, okachad indata, genererade utdata och trafik under högtrafik.
V4-Pro:s utdata kostar exempelvis omkring 128 procent mer under lågtrafik än det tidigare kampanjpriset på 0,87 dollar. Under högtrafik blir kostnaden cirka 355 procent högre, baserat på de angivna priserna.
Trots höjningen är DeepSeek fortfarande billigt jämfört med många slutna amerikanska modeller. Tidigare rapportering satte V4-Pro:s kampanjpris för utdata till ungefär 0,87 dollar per miljon token, medan ledande amerikanska modeller historiskt har kostat betydligt mer. DeepSeeks kostnadsfördel försvagas därför, men försvinner inte.
För en utvecklare som genererar 10 miljoner V4-Pro-token i månaden blir kalkylen för enbart utdata:
Det innebär en ökning på ungefär 11,10 till 30,90 dollar per månad, beroende på när trafiken körs. Beräkningen omfattar inte inmatningstoken, cacheavgifter, skatt eller andra plattformsavgifter.
För en produktionsapp kan den större frågan vara hur arbetsbelastningen ser ut snarare än hur mycket utdata som genereras. Långa instruktioner, låg cacheåteranvändning eller trafik som koncentreras till högtrafik kan ge en betydligt större kostnadsökning. Batchjobb bör därför i högre grad schemaläggas till lågtrafik, samtidigt som utvecklare behöver följa hur stor andel av anropen som ger cacheträff.
OpenAI har valt en annan väg för ChatGPT. GPT-5.6 Luna blir standardmodell för användare med Free- och Go-abonnemang, samtidigt som företaget lanserar obegränsade textchattar och en ny Think-knapp för mer krävande frågor.
Rubriken behöver dock en viktig brasklapp: obegränsad tillgång gäller textchattar, inte alla funktioner i ChatGPT. Begränsningar finns fortfarande för filuppladdningar, bilder, röst, bildgenerering och andra verktyg. Erbjudandet omfattas dessutom av skydd mot missbruk.
Det här är en distributionsstrategi för konsumentmarknaden, inte en förändring av API-priserna. OpenAI minskar tröskeln för vardaglig användning och placerar en kapabel modell direkt i den vanliga ChatGPT-upplevelsen. Enligt TechCrunch hade ChatGPT nyligen passerat 1 miljard veckovisa användare.
Låga tokenpriser har hjälpt kinesiska modeller att vinna utvecklartrafik. En mätning från Vercel AI Gateway visade att kinesiskt byggda modeller med öppna vikter stod för 29 procent av alla produktionstoken i juni 2026, upp från ungefär en niondel i april. Samtidigt stod modellerna för mindre än 4 procent av utgifterna. Siffrorna gäller just den gatewayen och ska inte tolkas som en mätning av hela den globala AI-marknaden.
Skillnaden är viktig. Tokenandel visar hur mycket arbete som går genom ett system, men säger inte i sig något om intäkter, lönsamhet, kundlojalitet eller varaktig marknadsmakt. Utvecklare kan styra om arbetsbelastningar mellan leverantörer, och priskänslig trafik kan flytta snabbt när villkoren ändras.
Den nya prislistan antyder att det inte längre räcker att vinna användning. Tidsbaserad prissättning ger DeepSeek möjlighet att fördela kapacitet efter belastning och ta mer betalt när efterfrågan är som störst. I företagets officiella dokumentation beskrivs ändringen som ett sätt att fördela resurser mer effektivt, samtidigt som användare uppmanas att schemalägga jobb efter faktisk användning.
Förändringen kommer också när andra kinesiska AI-bolag börjar ta betalt eller överväger högre priser. Rapportering från den bredare kinesiska marknaden har beskrivit hur Moonshot AI och ByteDance lanserat betalplaner och hur Alibaba förbereder sig för att följa efter. Det pekar mot en större förskjutning från aggressiva subventioner till intäktsgenerering.
Det bevisar inte att DeepSeek eller konkurrenterna är lönsamma. Men det visar att marknadsandelar som byggts genom låga priser så småningom måste omvandlas till intäkter per token, återkommande avtal eller någon annan affärsmodell som kan bära kostnaderna.
OpenAI:s kostnadsfria Luna-lansering handlar främst om distribution, inte om att erbjuda marknadens billigaste API. Genom att göra textchatt brett tillgängligt och lägga till en tydlig Think-knapp försöker företaget göra ChatGPT till en återkommande vana, samtidigt som dyrare funktioner fortsatt har snävare begränsningar.
Den strategiska kontrasten är tydlig:
Strategierna kan samexistera. En utvecklare kan välja DeepSeek för trafik i stor skala, medan en privat användare använder ChatGPT för allmän hjälp. Men båda företagen försöker göra sina ekosystem svårare att ersätta: DeepSeek genom pris och prestanda samt flexibel trafikstyrning, OpenAI genom produktvana och räckvidd.
DeepSeek är fortfarande ett lågprisalternativ, men den nya V4-prissättningen gör beskrivningen ”den billigaste modellen” otillräcklig. Utvecklare bör räkna på hela kostnaden utifrån cacheträffar, cachemissar, utdata och hur stor del av trafiken som infaller under högtrafik.
De praktiska frågorna är nu:
Den bredare AI-konkurrensen mellan Kina och USA handlar därför allt mindre om vem som kan erbjuda den lägsta rubrikprislappen. DeepSeek testar om kinesiska AI-labb kan omvandla kostnads- och prestandafördelen till hållbar ekonomi per enhet. OpenAI testar om gratis och vanebildande konsumenttillgång kan ge varaktig kontroll över ekosystemet.
I båda fallen är grundproblemet detsamma: att omvandla enorm användning till en affär som kan fortsätta finansiera den mycket dyra beräkningskraften bakom framtidens AI-modeller.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeeks priser för V4 Flash och V4 Pro ökar med mellan 50 och över 1 100 procent, beroende på modell, token typ och tid på dygnet.
DeepSeeks priser för V4 Flash och V4 Pro ökar med mellan 50 och över 1 100 procent, beroende på modell, token typ och tid på dygnet. De nya toppnivåerna gäller under 01.00–04.00 och 06.00–10.00 UTC. Övrig tid kostar hälften, men även lågtrafikpriserna ligger över de tidigare nivåerna.
För 10 miljoner genererade V4 Pro token per månad stiger kostnaden från 8,70 dollar till 19,80 dollar under lågtrafik – eller 39,60 dollar om allt körs under högtrafik.