Toto je příběh tohoto uvedení – co model skutečně umí, kolik stojí a proč představuje významný milník v probíhající soutěži mezi USA a Čínou v oblasti AI.
Kimi K3 dosáhl skóre 57,1 v nezávislém Artificial Analysis Intelligence Index v4.1, což jej řadí na 3. místo na světě za Claude Fable 5 (60) a GPT-5.6 Sol (59) . Rozdíl je zhruba 3 body – historicky velmi těsné – ale nejširší dostupný test inteligence stále favorizuje nejlepší americké modely
. Samotný Moonshot to přiznal a veřejně uvedl, že K3 „stále zaostává za nejvýkonnějšími proprietárními modely“ od Anthropicu a OpenAI, pokud jde o celkový agregovaný výkon
.
Tam, kde K3 vyniká, jsou konkrétní, reálné agentní benchmarky:
| Benchmark | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol | Claude Opus 4.8 |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 88,3 | 84,6 | 88,8 | 84,6 |
| DeepSWE | 73,0 | 70,0 | 67,5 | 59,0 |
| BrowseComp | 91,2 | 88,0 | 90,4 | 84,3 |
| Automation Bench | 75,6 | — | — | — |
| SpreadsheetBench 2 | 34,8 | 34,7 | 32,4 | 31,6 |
V těchto pěti agentních benchmarcích plus Program Bench (77,8) K3 vyhrál 5 ze 6 – porazil jak Fable 5, tak GPT-5.6 Sol . Také výrazně překonal Claude Opus 4.8 ve všech zveřejněných benchmarcích – což je důležité, protože Opus 4.8 stojí 5 USD za vstup / 25 USD za výstup na milion tokenů, což z něj dělá přímého cenového konkurenta
.
Na platformě Arena pro slepé hodnocení lidskými preferencemi, kterou vyvinuli výzkumníci z UC Berkeley, se K3 brzy po uvedení umístil na prvním místě v kódovacím žebříčku . Arena ukázala, že K3 obsadil první místo ve vývoji front-end webových aplikací se skóre 1 679, před Fable 5 (1 631) a GPT-5.6 Sol (1 618)
.
V oblasti optimalizace GPU kernelů – technik, které zlepšují interakci modelů AI s hardwarem – Moonshot uvedl, že K3 „výrazně předčil“ Opus 4.8, GPT-5.6 Sol a GPT-5.5 . To je komerčně významné, protože lepší optimalizace kernelů znamená nižší latenci a vyšší propustnost na stejném hardwaru.
Model využívá řídkou architekturu Mixture-of-Experts s 896 experty, z nichž je pro každý token aktivováno jen 16, což z něj dělá model srovnatelný s náklady na inferenci GPT-5.6 Sol i přes celkových 2,8 bilionu parametrů . Představuje také Kimi Delta Attention (KDA) a Attention Residuals (AttnRes) – nové architektonické součásti navržené ke zlepšení uvažování v dlouhých kontextech
.
Jedním z nejvíce trh narušujících aspektů Kimi K3 je cena API, která výrazně podbízí nejlepší americké modely:
| Model | Vstup (za 1M tokenů) | Výstup (za 1M tokenů) |
|---|---|---|
| Kimi K3 | 3,00 $ | 15,00 $ |
| GPT-5.6 Sol | 5,00 $ | 30,00 $ |
| Claude Fable 5 | 10,00 $ | 50,00 $ |
| Claude Opus 4.8 | 5,00 $ | 25,00 $ |
Kimi K3 stojí ~40 % méně než GPT-5.6 Sol a ~70 % méně než Claude Fable 5 . Tyto tři modely tvoří jasný 3,3× žebříček: Fable 5 stojí 3,3× více než Kimi K3 na vstupu i výstupu, GPT-5.6 Sol je přesně mezi nimi
.
Kromě toho má K3 cenu za vstup s cache-hit pouze 0,30 $ na milion tokenů – 10× levněji než při minutí cache – pro dotazy, které již byly dříve obslouženy . Na úkol se odhaduje, že K3 stojí 50–65 % méně než americké vlajkové lodě
.
Cenová politika Moonshotu u K3 představuje znatelný posun: model je nyní naceněn jako špičkový systém, nikoli jako levná varianta . Předchozí modely Kimi jako K2.5 a K2.6 stály 0,60 $ / vstup a 2,50–4,00 $ / výstup, takže K3 je zhruba 3–4× dražší než vlastní předchůdci
. I přesto zůstává levnější než špičkové americké modely a zároveň podává srovnatelný či lepší výkon ve specifických agentních úlohách.
Firma uvedla, že upřednostní výpočetní výkon pro stávající předplatitele a bude co nejrychleji přidávat kapacitu; nová místa pro registraci plánuje otevírat po dávkách . Stávající uživatelé měli plný přístup zachován a firemní a API služby fungovaly dál
.
Množství médií poznamenalo, že tato událost poukazuje na přetrvávající výpočetní omezení v Číně způsobená americkými exportními restrikcemi na čipy . Jihočínský ranní pošt napsal, že situace „podtrhuje výzvy, kterým čelí čínské AI laboratoře při poskytování svých produktů globálním uživatelům“
. Plné váhy modelu, které by třetím stranám umožnily provozovat jej na vlastním hardwaru, měly být vydány až 27. července – Moonshot tak byl po dobu launch okna jediným poskytovatelem inferenční kapacity
.
Moonshot využil pauzu k rozdělení členství na dva plány: Kimi Membership (pro web, aplikaci a Work) a Kimi Code Membership (pro programátorské workflow). Jde o restrukturalizaci navrženou k lepší alokaci výpočetních zdrojů .
Uvedení Kimi K3 mělo dopad přesahující AI benchmarky. Deník Straits Times přímo uvedl, že K3 „přiživil tech výprodej“ a několik médií spojilo vydání s výprodejem amerických akcií v oblasti polovodičů a AI . Ačkoli konkrétní údaje o směřování Philadelphie Semiconductor Indexu nebo pohybu akcií Nvidie nebylo možné nezávisle potvrdit z dostupných zdrojů, širší kontext výprodeje na trhu je dobře zdokumentován.
Na firemní straně Reuters 20. července 2026 uvedl, že pozastavení registrací „přichází ve chvíli, kdy společnost hledá nové financování a zdroje uvádějí, že se pohybuje směrem k primární veřejné nabídce v Hongkongu“ . Žádný zdroj v dostupných podkladech však nepotvrdil konkrétní usnesení akcionářů o cílové valuaci 30 miliard dolarů. Reuters zmiňuje snahu o IPO bez uvedení cílové valuace
.
Plné váhy modelu Kimi K3 jsou naplánovány na veřejné vydání 27. července 2026 . To je klíčový detail, protože to znamená, že si vývojáři a organizace budou moci model stáhnout, spouštět, prohlížet, dolaďovat a vlastnit, místo aby jej pouze pronajímali přes API
. Dvoufázové zavádění – nejprve API, o jedenáct dní později otevřené váhy – je tvarem celého oznámení
.
Do doby vydání otevřených vah mohou vývojáři přistupovat ke K3 přes kimi.com, Kimi API nebo OpenRouter . Model podporuje OpenAI SDK, volání nástrojů, strukturovaný výstup a automatické ukládání do cache a má kontextové okno o velikosti 1 milionu tokenů bez příplatku za dlouhý kontext
.
Spouštět model s 2,8 bilionu parametrů lokálně však není triviální. Velikost souboru se odhaduje na zhruba 1,5 TB a doporučený hardware zahrnuje 64+ podnikových NVIDIA H100 GPU . Pro většinu týmů zůstane API praktickým přístupovým bodem.
Kimi K3 není model, který by sesadil GPT-5.6 Sol nebo Claude Fable 5 z hlediska celkové inteligence – Moonshot sám to říká. Je to však model, který dokazuje, že otevřený systém může konkurovat špičkovým proprietárním modelům ve specifických, komerčně cenných úlohách a přitom stát zlomek ceny. Je to největší otevřený model, jaký byl kdy vydán, a přišel s takovou reálnou poptávkou, že během dvou dnů položil GPU infrastrukturu své vlastní firmy.
Tato kombinace – výkon na úrovni špičky v agentních benchmarcích, agresivní ceny, otevřené váhy a jasný signál poptávky – dělá z K3 významný milník v prostředí AI, bez ohledu na to, kde se nachází na kterémkoli žebříčku.