Modeller med öppna vikter nådde 62 procent av Vercels AI Gateway tokenvolym lördagen före den 25 augusti och hade därefter 54 procent, mot 46 procent för proprietära modeller. DeepSeek V4 Flash var den främsta drivkraften: uppdaterade vikter förbättrade modellens agentförmåga samtidigt som den behöll en tydlig kostn...
Research answer

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
En kombination av lägre kostnader och bättre kapacitet håller på att förändra trafikmönstret på Vercels AI Gateway. Tisdagen den 25 augusti 2026 stod modeller med öppna vikter för 54 procent av gatewayens tokenvolym, jämfört med 46 procent för proprietära modeller. Lördagen före nådde de enligt rapporteringen ett rekord på 62 procent, medan de slutna modellerna stod för 38 procent.4
Den närmaste utlösande faktorn var DeepSeek V4 Flash. Uppdaterade vikter förbättrade modellens resultat inom kodning, verktygsanvändning och agentbaserade arbetsflöden – utan att modellen placerades i den dyraste premiumklassen.19
| Rapporterad tidpunkt i augusti | Modeller med öppna vikter | Proprietära modeller |
|---|---|---|
| Lördagen före den 25 augusti | 62 % | 38 % |
| Tisdagen den 25 augusti | 54 % | 46 % |
På tisdagen hade modeller med öppna vikter alltså ett försprång på 8 procentenheter. Vid det tidigare rekordet var försprånget 24 procentenheter.
Det är viktigt att siffrorna gäller tokens som behandlats via gatewayen. De ska inte tolkas som ett mått på intäkter, vinster eller hur många företag som använder respektive modell.
Vercel uppger att DeepSeek V4 Flash började använda uppdaterade vikter som standard på AI Gateway. Modellens resultat i Terminal-Bench steg till 82,7 från 56,9 i aprilförhandsversionen – en förbättring på 25,8 procentenheter.19
Uppdateringen krävde varken ett nytt modell-ID eller ändringar i applikationskoden. Befintliga användare kunde därför få tillgång till de nya vikterna utan att bygga om sina integrationer.19
Modellens attraktionskraft handlar därmed om mer än att den är billig. Den förbättrade agentförmågan gör den bättre lämpad för omfattande kodnings- och verktygsarbetslaster, medan dess effektiviserade prisnivå ger utvecklare större kontroll över kostnaden för inferens – alltså beräkningen när modellen genererar svar.
Enligt Vercels beskrivning stöder DeepSeek V4 Flash resonemang, verktygsanvändning och implicit cachning samt har ett kontextfönster på 1 miljon tokens.27
Prissättningen förstärker den positionen. Reuters rapporterade att DeepSeeks V4 Pro lanserades med ett inpris på ungefär nio gånger V4 Flashs och ett utpris på ungefär 14 gånger V4 Flashs nivå.17 Oberoende jämförelser visar också en betydande prisfördel för V4 Flash, även om resultaten varierar beroende på test och konfiguration.25
Den tillgängliga rapporteringen kopplar nedgången i volym för proprietära modeller till svagare företagsefterfrågan på Anthropics dyrare Fable 5.4 Det är en rimlig förklaring för arbetslaster där genomströmning och kostnad per enhet väger tyngre än maximal modellkapacitet. Gateway-siffrorna bevisar däremot inte att detta var den enda orsaken för alla kunder eller förfrågningar.
Fable 5 är fortfarande positionerad för långvariga, tvetydiga och flerstegsbaserade uppgifter, enligt Vercels produktbeskrivning.3 Trafikförändringen i augusti ser därför mindre ut som ett universellt besked om att öppna modeller är bättre och mer som ett beslut om modellstyrning: använd en billigare modell för stora mängder lämpligt arbete och reservera dyrare proprietära modeller för uppgifter som motiverar merkostnaden.
Den viktigaste brasklappen är skillnaden mellan användning och intäkter. I en tidigare Vercel-rapport stod modeller med öppna vikter för 29 procent av gatewayens tokenvolym, men för mindre än 4 procent av utgifterna.44
Skillnaden beror på att antalet tokens inte visar vilket pris som betalats per in- eller utgående token. Proprietära modeller kan därför behålla en oproportionerligt stor andel av kostnaderna även när billigare modeller hanterar fler tokens.
Augustisiffrorna visar alltså att modeller med öppna vikter behandlade mer av gatewayens arbetslast – inte nödvändigtvis att de genererade mer affärer för modellleverantörerna.
Data pekar mot en mer medveten strategi för att fördela arbetslaster mellan modeller:
Den bredare lärdomen från Vercels augustitrafik är att modeller med öppna vikter kan vinna produktionsvolym när de kombinerar tillräcklig kapacitet med betydligt lägre kostnader. DeepSeek V4 Flash är det tydligaste exemplet, men den underliggande förändringen handlar snarare om att matcha varje arbetslast med den billigaste modell som fungerar tillräckligt tillförlitligt – inte om att ersätta alla proprietära modeller på en gång.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Modeller med öppna vikter nådde 62 procent av Vercels AI Gateway tokenvolym lördagen före den 25 augusti och hade därefter 54 procent, mot 46 procent för proprietära modeller.
Modeller med öppna vikter nådde 62 procent av Vercels AI Gateway tokenvolym lördagen före den 25 augusti och hade därefter 54 procent, mot 46 procent för proprietära modeller. DeepSeek V4 Flash var den främsta drivkraften: uppdaterade vikter förbättrade modellens agentförmåga samtidigt som den behöll en tydlig kostnadsfördel.
Skiftet innebär inte att öppna modeller stod för merparten av gatewayens utgifter.