Modeller med åpne vekter nådde 62 prosent av tokenvolumet på Vercels AI Gateway lørdagen før 25. DeepSeek V4 Flash var den viktigste drivkraften: Oppdaterte vekter ga et kraftig løft i agentegenskaper, samtidig som modellen beholdt et tydelig prisfortrinn.
Research answer

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Vercel AI Gateway viser et marked der kostnad og kapasitet veies stadig mer opp mot hverandre. Modeller med åpne vekter sto for 54 prosent av alle tokens som ble behandlet gjennom tjenesten tirsdag 25. august 2026. Proprietære modeller sto for de resterende 46 prosentene. Lørdagen før nådde andelen for åpne modeller en rapportert rekord på 62 prosent, mot 38 prosent for proprietære modeller.4
Vercel AI Gateway er en samlet inngang til mange KI-modeller. For utviklere gjør det enklere å bytte modell uten å endre hele infrastrukturen.
| Måling i august | Modeller med åpne vekter | Proprietære modeller |
|---|---|---|
| Lørdagen før 25. august | 62 % | 38 % |
| Tirsdag 25. august | 54 % | 46 % |
På tirsdagen hadde modeller med åpne vekter dermed et forsprang på åtte prosentpoeng. Ved den tidligere rekorden var forspranget 24 prosentpoeng.
Tallene gjelder tokens som er behandlet gjennom gatewayen. De sier ikke direkte noe om inntekter, fortjeneste eller hvor mange virksomheter som bruker de ulike modelltypene.
Den umiddelbare utløsende faktoren var DeepSeek V4 Flash. Vercel opplyser at modellen nå bruker oppdaterte vekter som standard på AI Gateway. På Terminal-Bench steg resultatet fra 56,9 i april-forhåndsvisningen til 82,7 – en forbedring på 25,8 poeng.19
Oppdateringen krevde verken en ny modell-ID eller endringer i applikasjonskoden. Eksisterende brukere kunne derfor få tilgang til de nye vektene uten å gjøre om integrasjonen sin.19
Det er også viktig fordi modellens appell ikke bare handler om å være billig. Bedre ytelse i agentbaserte arbeidsflyter gjør V4 Flash mer aktuell for omfattende kodearbeid og bruk av verktøy. Samtidig gir plasseringen i DeepSeeks effektivitetsklasse utviklere en måte å holde kostnadene for inferens nede på.
Vercel beskriver modellen som egnet for resonnering og verktøybruk, med implisitt caching og et kontekstvindu på 1 million tokens.27
Prisene forsterker dette bildet. Reuters rapporterte at DeepSeek lanserte V4 Pro til omtrent ni ganger høyere pris for input og 14 ganger høyere pris for output enn V4 Flash.17 Det synliggjør forskjellen mellom selskapets effektivitetsmodell og det dyrere flaggskipet.
Uavhengige sammenligninger viser også et betydelig prisfortrinn for V4 Flash, selv om resultatene varierer med test og konfigurasjon.25
For utviklere betyr det at V4 Flash kan være et naturlig valg for store mengder arbeid der gjennomstrømning og pris per token er viktigere enn maksimal modellkapasitet.
Tilgjengelig rapportering knytter nedgangen i volumet til svakere etterspørsel etter Anthropics dyrere Fable 5.4 Det kan være en rimelig forklaring for arbeidsoppgaver der utviklere prioriterer kapasitet og stykkøkonomi fremfor den høyest mulige ytelsen. Gateway-tallene beviser likevel ikke at dette var den eneste årsaken for alle kunder eller forespørsler.
Fable 5 er fortsatt posisjonert for langvarige, uklare og flertrinnsoppgaver, ifølge Vercels produktbeskrivelse.3 August-tallene ser derfor mindre ut som en generell dom over at åpne modeller er bedre, og mer som et resultat av aktiv modellruting:
Den viktigste innvendingen gjelder forskjellen mellom bruk og pengebruk. Tidligere Vercel-tall viste at modeller med åpne vekter sto for 29 prosent av gatewayens tokenvolum, men under 4 prosent av kostnadene.44
Årsaken er enkel: Antall tokens sier ikke hvor mye hvert input- eller output-token koster.
August-tallene viser derfor at åpne modeller behandlet mer av arbeidsmengden gjennom gatewayen. De viser ikke nødvendigvis at modellene sto for mesteparten av inntektene eller utgiftene. Proprietære modeller kan fortsatt ta en uforholdsmessig stor del av pengebruken selv om rimeligere åpne modeller håndterer flere tokens.
Skiftet peker mot en mer bevisst strategi for valg av modell:
Den bredere lærdommen fra Vercels augustdata er at modeller med åpne vekter kan vinne produksjonsvolum når de kombinerer tilstrekkelig kapasitet med langt lavere kostnader. DeepSeek V4 Flash er det tydeligste eksempelet, men utviklingen handler ikke nødvendigvis om å erstatte alle proprietære modeller. Den handler snarere om å matche hver arbeidsoppgave med den rimeligste modellen som løser den pålitelig nok.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Modeller med åpne vekter nådde 62 prosent av tokenvolumet på Vercels AI Gateway lørdagen før 25.
Modeller med åpne vekter nådde 62 prosent av tokenvolumet på Vercels AI Gateway lørdagen før 25. DeepSeek V4 Flash var den viktigste drivkraften: Oppdaterte vekter ga et kraftig løft i agentegenskaper, samtidig som modellen beholdt et tydelig prisfortrinn.
Skiftet betyr ikke nødvendigvis at åpne modeller sto for mesteparten av pengebruken.