DeepSeek od 17. srpna 2026 účtuje V4 Flash a V4 Pro podle času: mimošpičkové sazby jsou poloviční oproti špičkovým. Ve špičce stojí výstupní tokeny 9 jüanů za milion u V4 Flash a 27 jüanů u V4 Pro; vstup z cache zůstává výrazně levnější než necachovaný vstup.
Research answer

Create a landscape editorial hero image for this Studio Global article: What changed when DeepSeek’s new API pricing for DeepSeek-V4-Flash and DeepSeek-V4-Pro took effect at midnight on August 17, 2026—including. Article summary: At 00:00 Beijing time on August 17 (16:00 UTC on August 16), DeepSeek replaced flat V4 API pricing with time-of-use pricing: off-peak rates are exactly half peak rates. Peak is 09:00–12:00 and 14:00–18:00 Beijing time da. Topic tags: general, news, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, waterm
DeepSeek od 17. srpna 2026 ve 00:00 pekingského času změnil účtování API modelů V4 z jednotného ceníku na systém špičky a mimošpičky. To odpovídá 16. srpnu v 16:00 UTC, respektive 18:00 středoevropského letního času. Mimo špičku jsou ceny přesně poloviční oproti špičkovým sazbám. 1
2
Nový režim se týká modelů DeepSeek-V4-Flash a DeepSeek-V4-Pro. Špičkové hodiny podle pekingského času jsou každý den:
Všechny ostatní hodiny spadají do mimošpičkového režimu. U jednotlivého požadavku rozhoduje okamžik, kdy jej obdrží server platformy, nikoli nutně chvíle, kdy zpracování skončí. Pro vývojáře tak začíná být důležité plánovat provoz podle pekingského času. 2
7
Pro orientaci v českém čase jde v srpnu o 03:00–06:00 a 08:00–12:00 SELČ. Časy se však mohou lišit podle období roku, protože Peking letní čas nepoužívá.
Níže uvedené částky jsou v jüanech za milion tokenů. „Zásah cache“ znamená, že vstup využije dříve uložený prefix promptu. Při „nezasažení cache“ se vstup zpracovává za vyšší sazbu.
| Model a typ tokenů | Původní jednotná sazba | Mimo špičku | Změna oproti původní ceně | Špička | Změna oproti původní ceně |
|---|---|---|---|---|---|
| V4-Flash – vstup, zásah cache | ¥0,02 | ¥0,05 | +150 % | ¥0,10 | +400 % |
| V4-Flash – vstup, bez zásahu cache | ¥1,00 | ¥1,50 | +50 % | ¥3,00 | +200 % |
| V4-Flash – výstup | ¥2,00 | ¥4,50 | +125 % | ¥9,00 | +350 % |
| V4-Pro – vstup, zásah cache | ¥0,025 | ¥0,15 | +500 % | ¥0,30 | +1 100 % |
| V4-Pro – vstup, bez zásahu cache | ¥3,00 | ¥4,50 | +50 % | ¥9,00 | +200 % |
| V4-Pro – výstup | ¥6,00 | ¥13,50 | +125 % | ¥27,00 | +350 % |
U modelu Flash dokumentace uvádí mimo špičku sazby ¥0,05, ¥1,50 a ¥4,50 za milion tokenů pro vstup z cache, necachovaný vstup a výstup. Ve špičce ceny rostou na ¥0,10, ¥3 a ¥9. 2 Reuters uvedl, že celkové zvýšení podle modelu, typu tokenů a času používání dosahuje 50 až 1 100 %.
1
8
Vyhodnocování modelů, indexování dokumentů, zpětné zpracování dat, generování syntetických dat nebo jiné neurgentní úkoly mohou běžet mimo dvě špičková časová okna. Protože mimošpičková cena představuje polovinu špičkové sazby, může samotné plánování výrazně snížit náklady flexibilních úloh. 2
Fronta úloh tak nově potřebuje znát nejen termín dokončení, ale i pekingské fakturační okno. Pokud práce nemusí být hotová okamžitě, může ji systém odložit bez změny modelu nebo rozpočtu tokenů.
Zákaznická podpora, programátorské asistenty a agenti pracující v reálném čase musí reagovat tehdy, když jsou aktivní uživatelé. Špičkovým sazbám se proto často nevyhnou. Náklady ale mohou omezit opakovaným využíváním promptů, návrhem požadavků vhodným pro cache, kratšími odpověďmi a směrováním úloh mezi modely.
Cache je důležitá zejména proto, že vstup z cache zůstává u obou modelů výrazně levnější než vstup bez zásahu cache. U systémů, které opakovaně odesílají stejné instrukce, definice nástrojů nebo kontext dokumentů, může být zvýšení podílu zásahů cache důležitější než drobné omezení počtu požadavků.
Dlouhé řetězce uvažování, rozsáhlé reporty a velké bloky generovaného kódu spotřebovávají výstupní tokeny. Ve špičce stojí milion výstupních tokenů ¥9 u Flash a ¥27 u Pro. Vývojáři proto mohou nastavit přísnější limity odpovědí, používat Flash pro běžné požadavky a Pro si rezervovat pro úlohy, u nichž vyšší schopnosti ospravedlní příplatek. 1
2
Špičková cena vstupu z cache u V4-Pro je dvanáctinásobkem předchozí jednotné sazby, což představuje nejvyšší procentní nárůst v novém ceníku. V absolutních částkách zůstává nízká ve srovnání s necachovaným vstupem a výstupem. Výrazně se však projeví u aplikací, které ve velkém zpracovávají opakovaně cachované prompty. 1
19
Změna cen následovala po uvedení modelu DeepSeek-V4-Pro-0813 do obecné dostupnosti. Model je dostupný přes endpoint deepseek-v4-pro. Podle zveřejněných specifikací jde o textový model s kontextovým oknem o velikosti jednoho milionu tokenů, maximálním výstupem 384 000 tokenů a architekturou mixture-of-experts s přibližně 1,6 bilionu parametrů celkem a 49 miliardami aktivních parametrů na token. 29
33
Dokumentované limity souběžných požadavků se mezi oběma modely liší:
Požadavek zabírá slot až do dokončení, a to včetně streamované odpovědi. 28
Ceny a limity společně naznačují rozdělení produktů, v němž je Flash vhodnější pro běžný provoz s vysokou propustností, zatímco Pro představuje kapacitně omezenější variantu pro náročné uvažování a práci s dlouhým kontextem. Jde o závěr vyvozený z veřejných cen a limitů, nikoli o přímé tvrzení, že každý typ úlohy musí být řešen právě takto. 2
28
Přechod DeepSeeku připomíná řízení poptávky po výpočtech na GPU. Poskytovatelé čelí nejvyššímu náporu v době, kdy jsou online interaktivní uživatelé, zatímco dávkové úlohy často mohou počkat. Vyšší cena v těchto hodinách a nižší sazba mimo špičku vytvářejí motivaci rozložit výpočty během dne.
Pro vývojáře to mění způsob optimalizace nákladů. Nestačí už jen vybrat model a spočítat tokeny. Týmy musí také rozhodnout:
Širší význam spočívá v odklonu od soutěže založené pouze na jednotné ceně za token. Náklady se začínají odvíjet také od nedostatku kapacity v konkrétní dobu. DeepSeek nadále nabízí levnější režim pro flexibilní poptávku, zároveň však činí cenu špičkového inference citlivější na okamžik, kdy je kapacita využita. Reuters změnu popsal jako výrazné zvýšení, které se liší podle modelu, typu tokenu a času používání, nikoli jako jediný plošný příplatek. 1
Praktický závěr pro týmy využívající DeepSeek V4 je jednoduchý: plánování, cache, směrování požadavků a kontrola délky výstupu patří přímo do kalkulace ceny API. Úloha, která musí proběhnout okamžitě, může vyžadovat jiný model nebo přísnější tokenový rozpočet. Úloha, která počkat může, si naopak může značnou část původní ekonomiky zachovat spuštěním mimo špičku.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeek od 17. srpna 2026 účtuje V4 Flash a V4 Pro podle času: mimošpičkové sazby jsou poloviční oproti špičkovým.
DeepSeek od 17. srpna 2026 účtuje V4 Flash a V4 Pro podle času: mimošpičkové sazby jsou poloviční oproti špičkovým. Ve špičce stojí výstupní tokeny 9 jüanů za milion u V4 Flash a 27 jüanů u V4 Pro; vstup z cache zůstává výrazně levnější než necachovaný vstup.
Plánování úloh, opakované využívání promptů, volba modelu a omezení délky odpovědí se nově stávají součástí jednoho nákladového rozhodnutí.