Il quadro competitivo è sfumato, con prove coerenti da fonti indipendenti.
K3 batte GPT-5.5 e Claude Opus 4.8. Nei benchmark aggregati, Kimi K3 ottiene un punteggio di circa 80,96 contro il 73,51 di GPT-5.5, vincendo in 7 categorie su 9 . Sia SCMP che CNBC riferiscono che K3 "supera costantemente" GPT-5.5
. Batte anche Claude Opus 4.8, il modello di punta di fascia media di Anthropic, in molteplici benchmark
.
K3 è ancora dietro ai veri modelli di frontiera. Nell'intelligenza aggregata complessiva, K3 è in ritardo rispetto a Claude Fable 5 di Anthropic e a GPT-5.6 Sol di OpenAI. Secondo l'Artificial Analysis Intelligence Index, Claude Fable 5 ha un punteggio di 60, GPT-5.6 Sol di 59 e Kimi K3 di 57,1 . La stessa Moonshot riconosce questo divario
.
K3 domina nei benchmark di coding agentico. Questo è il vero punto di forza di K3. Vince in 5 dei 6 benchmark di coding agentico in scenari reali e ha conquistato il primo posto — davanti a Fable 5 — nel benchmark Arena per il coding front-end . Nella Design Arena, K3 ha ottenuto 1.679 punti contro i 1.631 di Fable 5 e i 1.618 di GPT-5.6 Sol
.
K3 è molto più economico. I costi di inferenza sono inferiori del 50-65% circa per attività completata rispetto a GPT-5.5 o Claude Opus 4.8, rendendo K3 "il re del rapporto qualità-prezzo del 2026" per gli sviluppatori che gestiscono carichi di lavoro agentici .
Nel febbraio 2026, Anthropic ha accusato formalmente DeepSeek, Moonshot AI e MiniMax di aver utilizzato una tecnica di "distillazione" per estrarre illecitamente capacità dai suoi modelli Claude . Secondo Anthropic, i tre laboratori cinesi avrebbero creato oltre 24.000 account fraudolenti e generato più di 16 milioni di conversazioni con Claude per sottrarre dati di addestramento
. La sola Moonshot AI è responsabile di oltre 3,4 milioni di scambi, mirati specificamente al ragionamento agentico, all'uso di strumenti e alle capacità di coding di Claude
.
Nel giugno 2026, Anthropic ha separatamente accusato Alibaba — uno degli investitori di Moonshot — di una simile campagna di estrazione "sfacciata" e "illecita" in una lettera al comitato bancario del Senato USA, sostenendo che coinvolgeva 25.000 account falsi e 28,8 milioni di scambi .
Moonshot AI non ha pubblicamente ammesso alcuna colpa; le accuse rimangono al momento non giudicate.
La traiettoria finanziaria di Moonshot AI è stata straordinaria. A dicembre 2024, la società era valutata circa 4,3 miliardi di dollari . Nel maggio 2026, ha raccolto circa 2 miliardi di dollari in un round guidato dal ramo venture di Meituan, con una valutazione superiore a 20 miliardi
. A giugno 2026, ha iniziato a cercare un nuovo round con una valutazione di 30 miliardi
. Poche settimane dopo il lancio di Kimi K3, Bloomberg ha riferito che Moonshot si sta preparando ad avviare discussioni ad agosto per un round finale pre-IPO con una valutazione fino a 50 miliardi di dollari
. Un'IPO a Hong Kong è in fase di valutazione attiva; la società ha già avuto colloqui con CICC e Goldman Sachs già a marzo 2026
. La domanda è stata così intensa che Moonshot ha temporaneamente sospeso i nuovi abbonamenti a Kimi a causa della capacità messa a dura prova
.
I risultati di ricerca disponibili non contengono alcuna notizia verificata riguardo all'affermazione di Moonshot AI secondo cui K3 opererebbe con una "supervisione umana minima". Questo elemento sembra non essere supportato: non ci sono prove sufficienti nel materiale raccolto per confermare o caratterizzare tale affermazione.
Inoltre, sebbene il contesto generale dei controlli all'esportazione dell'amministrazione Trump sull'AI cinese sia ben documentato, non è stato possibile verificare con fonti aggiornate se l'amministrazione stia attivamente considerando di aggiungere specifici laboratori cinesi di AI (incluso Moonshot) alla Entity List.