Anthropic uvádí, že Claude Opus 5.5 vychází v typické tokenově účtované zátěži asi o 40 % levněji než Opus 5; OpenAI snížila ceny GPT 6 Sol a Luna o 50 % oproti akčním cenám GPT 5.6. U agentů a programovacích workflow hrají zásadní roli opakovaně používaný kontext, cache, počet tokenů potřebných k dokončení úkolu i...
PublikovalUpraveno pomocí GPT-5.6 TerraObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How did Anthropic’s launch of Claude Opus 5.5 and OpenAI’s near-simultaneous release of GPT-6 Sol and GPT-6 Luna—featuring lower API prices,. Article summary: The releases reframed the contest around the economics of deploying capable AI at scale: not simply which lab has the highest-scoring frontier model, but which can complete a coding, support, research, or agentic workflo. Topic tags: general, news, general web, documentation, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Miliarda tokenů může v ceníku vypadat levně. To ale samo o sobě neříká, kolik firmu skutečně stojí automatizovat zákaznický servis, zpracovat dokumenty, napsat a zkontrolovat kód nebo provozovat vícekrokového AI agenta.
Zářijové novinky Anthropic a OpenAI naznačují posun v soutěži mezi dodavateli: špičková schopnost modelu zůstává důležitá, avšak podniky stále častěji potřebují znát hlavně cenu spolehlivě dokončeného úkolu ve velkém měřítku.
Do této ceny patří nejen vstupní a výstupní tokeny, ale i množství tokenů, které model spotřebuje k dosažení výsledku, míra využití cache, odezva a především to, zda úkol uspěje bez opakovaných pokusů nebo nákladné kontroly člověkem.
Anthropic stanovila u Claude Opus 5.5 cenu na 4 USD za milion vstupních tokenů a 20 USD za milion výstupních tokenů. To je o 20 % méně než u Claude Opus 5. Firma zároveň odhaduje, že v typických tokenově účtovaných úlohách bude provoz Opus 5.5 zhruba o 40 % levnější, protože model vyžaduje méně výpočetního výkonu při obsluze a s tokeny pracuje efektivněji. Cena za čtení z cache klesla o 60 % na 0,20 USD za milion tokenů. 21
OpenAI staví GPT-6 Sol a GPT-6 Luna na obdobném argumentu. Uvedla, že zlepšení cache a inference jí umožnilo snížit ceny API o 50 % proti akčním cenám GPT-5.6. GPT-6 Sol stojí 2 USD za vstup a 10 USD za výstup na milion tokenů; GPT-6 Luna pak 0,10 USD za vstup a 0,50 USD za výstup. 24
Z těchto ceníků nelze mechanicky vyvodit, který model je „nejlevnější“. Modely se liší objemem generovaného výstupu, kvalitou, rychlostí, prací s kontextem i spolehlivostí v konkrétních úkolech. Společné sdělení je však zřejmé: dodavatelé neprodávají jen levnější tokeny, ale více užitečné práce za stejný dolar.
Prompt caching, tedy opětovné využití již zpracovaného vstupního kontextu, má velký dopad hlavně u dlouhých programátorských a agentních procesů. Ty mohou v každém kroku znovu posílat rozsáhlé systémové instrukce, kontext zdrojového kódu, interní pravidla, definice nástrojů nebo historii konverzace.
Jestliže se tento opakovaný materiál načítá z cache s výraznou slevou, může celková cena workflow citelně klesnout. Anthropic uvádí, že čtení z cache tvoří velkou část nákladů dlouhodobě běžících agentních úloh; proto je snížení ceny cache-read u Opus 5.5 podstatnější, než by napovídalo samotné zlevnění standardního vstupu. 21
Také OpenAI připsala zlevnění modelů Sol a Luna efektivnější cache a inferenci. 24 Při porovnávání nabídek proto nestačí zadat jednomu modelu krátký testovací dotaz. Je potřeba měřit reálné prompty, opakovaně používaný kontext a vícekrokové pracovní postupy.
Američtí poskytovatelé API nemohou přehlížet levnější modely s otevřenými vahami ani konkurenci z Číny. Reuters s odvoláním na testy výzkumné firmy uvedl, že DeepSeek V4-Flash vycházel přibližně 105krát levněji než Claude Fable 5. Uváděné API ceny činily 0,14 USD za milion vstupních a 0,28 USD za milion výstupních tokenů. 1
Cena samozřejmě není jediným kritériem. Firmy mohou podle použití různě vážit kvalitu, bezpečnostní postupy, podporu, ochranu dat, integrace a provozní spolehlivost. Výrazný rozdíl v provozních nákladech přesto dává silný důvod směrovat jednodušší, objemné úlohy k levnějším alternativám.
Příklad představuje i Kimi K3 od Moonshot AI. Společnost uvedla, že její model zaostává za vedoucími systémy Anthropic a OpenAI v celkovém výkonu, ale v některých programátorských a agentních benchmarkách překonal vybrané předchozí modely blízko špičce. 6 Právě tato kombinace — dostatečně konkurenceschopný výkon v části práce a nižší náklady — nutí uzavřené modely přesvědčivě ukazovat, proč se jejich vyšší cena u daného workflow vyplatí.
Tyto produkty posilují portfoliový přístup k firemní AI:
Praktickým výsledkem není volba jednoho univerzálního vítěze, ale směrování úloh mezi modely. Firma může nejsložitější výjimky předat dražšímu systému a běžné požadavky levnější variantě. Celkové výdaje tak mohou klesnout, aniž by každá jednotlivá úloha musela přijmout kompromisy nejlevnějšího dostupného modelu.
Užitečné srovnání se ptá na cenu výsledku, nikoli na cenu milionu tokenů. Týmy by měly sledovat zejména:
Špičkové modely tím neztrácejí význam — zůstávají nejvyšší vrstvou nabídky. Pro široké podnikové nasazení ale poskytovatelé AI musí stále přesvědčivěji spojovat schopnosti s ekonomikou konkrétního workflow: efektivní inferencí, nižší spotřebou tokenů, dobře využitelnou cache a jasnou volbou správného modelu pro správně naceněný úkol. 21
24
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Anthropic uvádí, že Claude Opus 5.5 vychází v typické tokenově účtované zátěži asi o 40 % levněji než Opus 5; OpenAI snížila ceny GPT 6 Sol a Luna o 50 % oproti akčním cenám GPT 5.6.
Anthropic uvádí, že Claude Opus 5.5 vychází v typické tokenově účtované zátěži asi o 40 % levněji než Opus 5; OpenAI snížila ceny GPT 6 Sol a Luna o 50 % oproti akčním cenám GPT 5.6. U agentů a programovacích workflow hrají zásadní roli opakovaně používaný kontext, cache, počet tokenů potřebných k dokončení úkolu i počet nutných oprav.
Nastupuje modelový „žebřík“: prémiové modely pro nejtěžší případy, výkonné produkční modely pro běžné nasazení a levné varianty pro rutinní automatizaci ve velkém objemu.