Open weight modely dosáhly v sobotu před 25. srpnem rekordního podílu 62 % tokenů na Vercel AI Gateway; v úterý držely 54 % oproti 46 % u proprietárních modelů.
Research answer

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Na trhu s AI se mění jednoduché pravidlo: pro velké objemy práce nemusí být nejvýhodnější nejdražší model. Open-weight modely, tedy modely s veřejně dostupnými váhami, tvořily v úterý 25. srpna 2026 celkem 54 % objemu tokenů zpracovaných přes Vercel AI Gateway. Proprietární modely se uzavřenými váhami měly 46 %.4
Ještě výraznější byl výsledek v sobotu před tímto úterým, kdy podíl open-weight modelů podle dostupných údajů dosáhl rekordních 62 %. Na proprietární modely tehdy připadlo 38 %.4
Bezprostředním impulzem byl DeepSeek V4 Flash. Aktualizace jeho vah zlepšila výsledky při programování, práci s nástroji a agentních pracovních postupech, aniž by se z modelu stal prémiově ceněný produkt.19
| Sledovaný bod v srpnu | Open-weight modely | Proprietární modely |
|---|---|---|
| Sobota před 25. srpnem | 62 % | 38 % |
| Úterý 25. srpna | 54 % | 46 % |
V úterý tak měly open-weight modely náskok 8 procentních bodů. Při předchozím rekordu činil náskok 24 bodů. Jde ovšem výhradně o podíl zpracovaných tokenů v rámci gateway, tedy sjednoceného rozhraní, přes které mohou vývojáři přistupovat ke stovkám modelů. Údaje nelze zaměňovat za podíl na tržbách, zisku ani za počet firem využívajících jednotlivé modely.
Vercel uvedl, že DeepSeek V4 Flash začal v AI Gateway standardně používat aktualizované váhy. Jeho skóre v testu Terminal-Bench vzrostlo z 56,9 bodu v dubnové preview verzi na 82,7 bodu, tedy o 25,8 bodu.19 Stávající uživatelé přitom nemuseli měnit identifikátor modelu ani kód aplikace — novější váhy se jim načetly automaticky.19
Výhoda modelu tedy nespočívá jen v nízké ceně. Lepší výkon v agentních úlohách rozšiřuje jeho využití pro hromadné programování a volání nástrojů, zatímco zařazení do úspornější kategorie pomáhá vývojářům kontrolovat náklady na inferenci. Podle popisu Vercelu model podporuje reasoning, používání nástrojů a implicitní cachování a pracuje s kontextovým oknem o velikosti 1 milionu tokenů.27
Cenový rozdíl dále zvýraznilo uvedení modelu DeepSeek V4 Pro. Reuters uvedl, že jeho cena za vstupní tokeny byla přibližně devítinásobná a za výstupní tokeny čtrnáctinásobná oproti V4 Flash.17 Nezávislá srovnání rovněž ukazují výraznou cenovou výhodu V4 Flash, i když výsledky benchmarků se liší podle testu a konfigurace.25
Dostupné zprávy spojují pokles objemu proprietárních modelů s nižší obchodní poptávkou po dražším modelu Anthropic Fable 5.4 Takové vysvětlení dává smysl u úloh, kde je pro vývojáře důležitější propustnost a cena za jednotku než maximální možná schopnost modelu. Samotná data z gateway však nedokazují, že šlo o jedinou příčinu u všech zákazníků a požadavků.
Fable 5 zůstává podle produktového popisu Vercelu určen především pro dlouhé, nejednoznačné a vícekrokové úlohy.3 Srpnový posun proto nevypadá jako všeobecný verdikt, že open-weight modely jsou lepší. Spíše ukazuje na přesnější směrování úloh: levnější model pro velké objemy vhodné práce a prémiový proprietární model tam, kde jeho vyšší cena odpovídá přínosu.
Nejdůležitější výhradou je rozdíl mezi využitím a tržbami. V dřívějším reportingu Vercelu vzrostl podíl open-weight modelů na 29 % objemu tokenů, ale na výdajích se podílely méně než 4 %.44 Důvodem je, že samotný počet tokenů neříká, kolik stojí vstupní a výstupní token u konkrétního modelu.
Srpnový přelom tedy znamená, že open-weight modely zpracovávaly větší část práce na gateway. Neznamená automaticky, že generovaly větší příjmy poskytovatelům. Proprietární modely mohou mít nadále nepoměrně vysoký podíl na útratě, i když levnější open-weight modely obsluhují více tokenů.
Data podporují promyšlenější strategii směrování požadavků mezi modely:
Širší poučení z provozu Vercel AI Gateway v srpnu je zřejmé: open-weight modely mohou získat většinu produkčního objemu, pokud nabídnou dostatečné schopnosti za výrazně nižší cenu. DeepSeek V4 Flash je zatím nejvýraznějším příkladem. Nejde však o okamžité nahrazení všech proprietárních modelů, ale o hledání nejlevnějšího modelu, který danou úlohu zvládne dostatečně spolehlivě.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Open weight modely dosáhly v sobotu před 25. srpnem rekordního podílu 62 % tokenů na Vercel AI Gateway; v úterý držely 54 % oproti 46 % u proprietárních modelů.
Open weight modely dosáhly v sobotu před 25. srpnem rekordního podílu 62 % tokenů na Vercel AI Gateway; v úterý držely 54 % oproti 46 % u proprietárních modelů. Hlavním impulzem byl DeepSeek V4 Flash, jehož aktualizované váhy výrazně zlepšily výkon při programování, používání nástrojů a agentních úlohách, zatímco si zachoval cenovou výhodu.
Vyšší podíl tokenů neznamená vyšší podíl na výdajích: dřívější data Vercelu ukázala, že open weight modely zpracovávaly 29 % tokenů, ale představovaly méně než 4 % útraty.