Silicon Datas viktade index för LLM tokenpriser föll till rekordlåga 0,97 dollar per miljon token den 1 september 2026, mindre än hälften av sommarens tidigare toppnivå. DeepSeek V4 Flash, med ett listpris på 0,14 dollar per miljon inputtoken, visar hur långt prisgolvet har flyttats ned i den kinesiska AI marknaden.
Research answer

Create a landscape editorial hero image for this Studio Global article: How has the Chinese AI-lab price war—marked by June 2026 international API cuts of 50–99% by DeepSeek, Alibaba Cloud, ByteDance, Moonshot AI. Article summary: China’s price war appears to have reset the marginal market price of LLM inference rather than reduced demand. Aggressive low-cost Chinese APIs pulled customers toward cheaper models and altered the usage mix, helping dr. Topic tags: general, general web, user generated, education, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
Silicon Datas LLM Token Expenditure Index föll till 0,97 dollar per miljon token den 1 september 2026 – den lägsta nivån hittills och mindre än hälften av indexets tidigare sommartopp. Kinesiska AI-bolags aggressiva API-prissättning har bidragit till att ändra marknadens syn på vad rutinmässig AI-inferens, alltså när en färdigtränad språkmodell används, bör kosta. 2
4
Det betyder dock inte att AI-efterfrågan har fallit. Tvärtom kan en lägre kostnad per token göra det lönsamt att använda AI till fler uppgifter. Därmed kan både tokenvolymerna och de samlade AI-utgifterna fortsätta upp.
SDLLMTK är inte ett mått på alla token som används eller på marknadens totala AI-intäkter. Silicon Data beskriver indexet som ett riktmärke för det blandade, användningsviktade priset för LLM-inferens per miljon token. Det kombinerar leverantörernas priser med observerad konsumtion inom ett definierat urval av modeller. 2
4
Det är en viktig skillnad. Om kunder flyttar en större del av sina arbetslaster till billigare modeller kan indexet sjunka, även om de använder fler token totalt och samtidigt lägger mer pengar på AI. Indexet fångar alltså både prisnivån och vilken typ av modeller som faktiskt används – inte hela marknadens omsättning.
Priskonkurrensen har gett företag mycket billiga alternativ för arbetsuppgifter som inte kräver de dyraste frontmodellerna. DeepSeek V4-Flash listades exempelvis till 0,14 dollar per miljon inputtoken och 0,28 dollar per miljon outputtoken. 49
DeepSeek sänkte också priset på V4-Pro med 75 procent i maj 2026, ett drag som beskrevs som en upptrappning i konkurrensen mellan kinesiska modellleverantörer. 58 Fler prissänkningar och lågprisalternativ i det kinesiska AI-ekosystemet har ökat pressen på leverantörer som konkurrerar om högvolymsanvändning av inferens.
4
52
Underlaget visar ett tydligt samband mellan konkurrenssituationen och fallande blandade tokenpriser. Däremot går det inte att slå fast exakt hur stor del av nedgången som beror på ett enskilt bolag, en viss modell eller en enskild prissänkning. Effektivare modeller, utbyggd kapacitet och kundernas egna val av modell påverkar också indexet.
Sambandet kan förenklas så här:
samlad tokenkostnad = effektivt pris per token × tokenvolym
När styckpriset faller blir fler användningsfall ekonomiskt rimliga. Företag kan driftsätta fler automatiserade arbetsflöden, använda längre promptar och större kontextfönster, generera mer kod eller låta fler AI-agenter arbeta självständigt.
Om tokenvolymen ökar snabbare än det effektiva priset faller, stiger den totala AI-kostnaden. Det stämmer med uppgifter om att priset per token har fallit med mer än 90 procent sedan 2023, medan utgifterna för användning av stora språkmodeller ungefär har fördubblats sedan slutet av 2025. 41
43
Det är alltså inte ett tecken på att prissänkningarna misslyckats. Tvärtom breddar billigare inferens antalet uppgifter som är värda att automatisera.
Den dagliga AI-tokenanvändningen i Kina översteg 140 biljoner i mars 2026, upp från 100 biljoner vid slutet av 2025, enligt statliga prognoser som Reuters hänvisar till. 18
Även företags- och bankuppgifter pekar åt samma håll. China Merchants Bank uppgav att dess genomsnittliga dagliga tokengenomströmning steg med över 78 procent jämfört med året före. Separat rapportering angav bankens dagliga användning till omkring 33 miljarder token i slutet av maj. 19
29 Andra kinesiska banker uppges ha redovisat betydligt större ökningar i sin genomsnittliga dagliga tokenanvändning.
20
Siffrorna är varken ett direkt mått på API-intäkter eller ett bevis på att varje AI-arbetslast är företagsekonomiskt lönsam. Men de visar att billigare inferens omsätts i kraftigt ökad användning i stor skala.
För AI-köpare är sjunkande inferenspriser en klar fördel. För modellleverantörerna blir affärsmodellen mer ansträngd: intäkten per token kan falla samtidigt som kostnaderna för chip, datacenter, träning och fortsatt modellutveckling är höga.
Huvudfrågan är därför inte längre om kunderna kommer att använda billiga token. Tillgängliga data tyder på att de gör det. Frågan är om högre volymer, premiumtjänster och företagsprodukter kan skapa hållbara intäkter och mätbara produktivitetsvinster tillräckligt snabbt för att motivera fortsatta infrastrukturinvesteringar. Rapporteringen om indexfallet har lyft risken för pressad prissättningskraft hos leverantörerna. 4
36
Ett enskilt modells listpris säger allt mindre om marknaden. Mer användbara indikatorer är:
Slutsatsen är enkel: Kinas lågpriskonkurrens för AI-API:er har bidragit till att göra LLM-inferens dramatiskt billigare och pressat det blandade marknadspriset under en dollar per miljon token. Men de lägre priserna driver också fram mer användning. Därför kan tokenförbrukningen och de samlade AI-utgifterna fortsätta stiga samtidigt. 2
4
41
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Silicon Datas viktade index för LLM tokenpriser föll till rekordlåga 0,97 dollar per miljon token den 1 september 2026, mindre än hälften av sommarens tidigare toppnivå.
Silicon Datas viktade index för LLM tokenpriser föll till rekordlåga 0,97 dollar per miljon token den 1 september 2026, mindre än hälften av sommarens tidigare toppnivå. DeepSeek V4 Flash, med ett listpris på 0,14 dollar per miljon inputtoken, visar hur långt prisgolvet har flyttats ned i den kinesiska AI marknaden.
Lägre styckpris behöver inte ge lägre AI budgetar: när företag automatiserar fler flöden och använder fler AI agenter kan tokenvolymen och den samlade kostnaden ändå öka.