Silicon Datas LLM Token Expenditure Index – Indekset faldt fra over $2 pr. million tokens i starten af juni til $1,20 i den første uge af august – et fald på omkring 40% på to måneder . En måling den 27. juli viste $1,43, hvilket bekræfter den nedadgående tendens
. Silicon Data peger specifikt på kinesiske open-weight-modeller som en primær årsag til faldet i indeksgennemsnittet
.
OpenAI sænkede API-priserne med op til 80% med henvisning til forbedringer i infrastruktureffektivitet. Trækket pressede markedsgennemsnittet direkte ned; CNBC og Forbes beskrev det som en optrapning af AI-priskrigen .
OpenAI tilskrev reduktionerne til interne optimeringer, herunder kernel-omskrivninger og spekulativ afkodning, som angiveligt gav 20-35% effektivitetsforbedringer i inferensarbejdsbyrder .
Den 31. juli 2026 udgav DeepSeek V4-Flash-0731 i offentlig beta med uændrede priser:
Til cirka en tiendedel af prisen på premium-modeller satte DeepSeek V4 Flash en bundpris, der tvang en bredere markedskompression. Ifølge benchmark-firmaet Artificial Analysis er V4 Flash's estimerede pris pr. opgave cirka 3 cent . Modellen slår DeepSeeks egen V4 Pro preview på alle agentiske benchmarks, som DeepSeek har offentliggjort, til en tredjedel af output-prisen
.