Avoimien painojen osuus Vercel AI Gatewayn käsittelemästä tokenimäärästä nousi elokuun 25. Keskeinen vauhdittaja oli DeepSeek V4 Flash, jonka päivitetyt painot paransivat agenttitehtävien suorituskykyä samalla, kun malli säilytti kustannustehokkaan asemansa.
Research answer

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Vercel AI Gatewayn liikenne kertoo tekoälymarkkinan muuttuvasta laskelmasta: tuotantokäytössä riittävä suorituskyky yhdistettynä matalaan tokenhintaan voi olla arvokkaampaa kuin paras mahdollinen mallikyvykkyys joka tehtävässä.
Avoimien painojen mallit muodostivat tiistaina 25. elokuuta 2026 54 prosenttia yhdysvaltalaisen Vercel AI Gatewayn tokenimäärästä, kun suljettujen eli omistusoikeudellisten mallien osuus oli 46 prosenttia. Edeltävänä lauantaina avoimien mallien osuus oli yltänyt raportoituun ennätykseen, 62 prosenttiin, ja suljettujen mallien osuudeksi jäi 38 prosenttia.4
| Raportoitu ajankohta elokuussa | Avoimet painot | Suljetut mallit |
|---|---|---|
| Edeltävä lauantai | 62 % | 38 % |
| Tiistai 25. elokuuta | 54 % | 46 % |
Tiistaina avoimilla malleilla oli siis kahdeksan prosenttiyksikön etumatka. Aiemmassa ennätyslukemassa ero oli jo 24 prosenttiyksikköä.
On kuitenkin tärkeää huomata, mitä luvut mittaavat. Kyse on Gatewayn kautta käsiteltyjen tokenien määrästä, ei liikevaihdosta, voitosta tai siitä, kuinka moni yritys käyttää kumpaakin mallityyppiä.
Vercelin mukaan DeepSeek V4 Flash alkoi käyttää AI Gatewayssä oletuksena päivitettyjä painoja. Terminal-Bench-testissä sen tulos nousi huhtikuun esiversion 56,9 pisteestä 82,7 pisteeseen – parannusta kertyi 25,8 pistettä.19
Päivityksen käyttöönotto oli kehittäjille poikkeuksellisen kitkatonta: mallin tunnistetta tai sovelluskoodia ei tarvinnut muuttaa, joten nykyiset käyttäjät saivat uudet painot käyttöön automaattisesti.19
V4 Flashin vetovoima ei siten perustunut vain halpaan hintaan. Parempi suorituskyky koodauksessa, työkalujen käytössä ja agenttimaisissa työnkuluissa teki siitä sopivamman suuren volyymin tehtäviin. Malli tukee päättelyä, työkalujen käyttöä ja implisiittistä välimuistia, ja sen konteksti-ikkuna on miljoona tokenia.27
Hinnoittelu vahvisti tätä asemaa. Reutersin mukaan DeepSeekin V4 Pro julkaistiin noin yhdeksänkertaisella syötehinnalla ja 14-kertaisella tulostehinnalla V4 Flashiin verrattuna.17 Myös riippumattomat vertailut osoittavat V4 Flashille huomattavan hintaedun, vaikka tulokset vaihtelevat testin ja käytetyn kokoonpanon mukaan.25
Saatavilla oleva raportointi yhdistää suljettujen mallien tokenimäärän laskun Anthropic-yhtiön kalliimman Fable 5 -mallin heikentyneeseen yrityskysyntään.4 Selitys sopii käyttötapauksiin, joissa kehittäjille läpimeno ja yksikkökustannus ovat tärkeämpiä kuin suurin mahdollinen mallikyvykkyys.
Gatewayn luvut eivät kuitenkaan todista, että kyse olisi ollut kaikkien asiakkaiden tai pyyntöjen ainoasta syystä. Vercel asemoi Fable 5:n edelleen malliksi, joka on tarkoitettu pitkiin, monivaiheisiin ja epäselviin tehtäviin.3
Siksi elokuun muutos näyttää pikemminkin reititysratkaisulta kuin julistukselta siitä, että avoimet mallit olisivat kaikissa tehtävissä parempia. Halvempi malli voidaan valita suureen määrään sopivia työtehtäviä, kun taas kalliimpi omistusoikeudellinen malli säästetään tilanteisiin, joissa sen lisäkyvykkyys perustelee hinnan.
Suurin varoitusmerkki liittyy käytön ja rahan eroon. Vercelin aiemman raportoinnin mukaan avoimet painot nousivat 29 prosenttiin Gatewayn tokenimäärästä, mutta muodostivat alle neljä prosenttia kuluista.44
Ero johtuu siitä, että tokenien lukumäärä ei kerro syöte- ja tulostokenien hintaa. Halpa malli voi siis käsitellä enemmistön tokeneista, vaikka kalliimmat suljetut mallit keräisivät edelleen suuremman osuuden kokonaismenoista.
Elokuun luvut osoittavat ennen kaikkea, että avoimet mallit käsittelivät suuremman osan Gatewayn työkuormasta. Ne eivät yksinään osoita, että avoimet mallit olisivat tuottaneet palveluntarjoajille enemmän liiketoimintaa.
Muutos tukee aiempaa tarkempaa mallien reititystä:
Vercelin elokuun liikenne tarjoaa laajemman opetuksen: avoimet painot voivat vallata tuotantovolyymin, kun ne yhdistävät riittävän kyvykkyyden ja selvästi matalamman hinnan. DeepSeek V4 Flash on tästä näkyvin esimerkki. Kehitys ei kuitenkaan tarkoita kaikkien suljettujen mallien korvautumista, vaan siirtymää kohti mallikohtaista optimointia – jokaiseen tehtävään pyritään valitsemaan halvin riittävän luotettava vaihtoehto.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Avoimien painojen osuus Vercel AI Gatewayn käsittelemästä tokenimäärästä nousi elokuun 25.
Avoimien painojen osuus Vercel AI Gatewayn käsittelemästä tokenimäärästä nousi elokuun 25. Keskeinen vauhdittaja oli DeepSeek V4 Flash, jonka päivitetyt painot paransivat agenttitehtävien suorituskykyä samalla, kun malli säilytti kustannustehokkaan asemansa.
Avoimien mallien suurempi tokenimäärä ei tarkoita, että ne hallitsisivat myös palvelun rahankäyttöä: aiempien Vercel tietojen mukaan suljetut mallit saattoivat kerätä suurimman osan kuluista huomattavasti pienemmällä...