競爭形勢相當複雜,多個獨立來源嘅證據都一致。
K3 打贏 GPT-5.5 同 Claude Opus 4.8。 喺綜合基準測試上,Kimi K3 得分大約 80.96,而 GPT-5.5 只有 73.51,喺 9 個基準類別入面贏咗 7 個 。《南華早報》同 CNBC 都報道 K3「 consistently outperforming」GPT-5.5
。K3 亦都喺多個基準上贏咗 Anthropic 嘅中階旗艦 Claude Opus 4.8
。
K3 仍然落後真正嘅頂尖模型。 喺整體智能上,K3 落後 Anthropic 嘅 Claude Fable 5 同 OpenAI 嘅 GPT-5.6 Sol。根據 Artificial Analysis Intelligence Index,Claude Fable 5 得分 60,GPT-5.6 Sol 得分 59,而 Kimi K3 係 57.1 。Moonshot 自己都承認呢個差距
。
K3 喺 agentic 編程基準上稱霸。 呢個係 K3 最強嘅地方。佢喺 6 個真實世界 agentic 編程基準入面贏咗 5 個,仲喺前端編程嘅 Arena 基準上奪得第一,甚至超越咗 Fable 5 。喺 Design Arena 上,K3 攞到 1,679 分,而 Fable 5 係 1,631 分,GPT-5.6 Sol 係 1,618 分
。
K3 平好多。 每次完成任務嘅推理成本大約比 GPT-5.5 或 Claude Opus 4.8 平 50–65%,對於運行 agentic 工作嘅開發者嚟講,K3 可謂「2026 年嘅性價比之王」。
2026 年 2 月,Anthropic 正式指控 DeepSeek、Moonshot AI 同 MiniMax 使用「蒸餾」技術,非法從佢哋嘅 Claude 模型中提取能力 。Anthropic 話,呢三間中國實驗室涉嫌設立超過 24,000 個假賬戶,同 Claude 進行咗超過 1,600 萬次對話嚟竊取訓練數據
。其中 Moonshot AI 佔咗超過 340 萬次對話,專門針對 Claude 嘅 agentic 推理、工具使用同編程能力
。
2026 年 6 月,Anthropic 另外指控阿里巴巴——佢哋係 Moonshot 嘅投資者——進行類似嘅「膽大妄為」同「非法」嘅提取行動,喺一封畀美國參議院銀行委員會嘅信中,指控阿里巴巴涉及 25,000 個假賬戶同 2,880 萬次對話 。
Moonshot AI 至今未有公開承認有不當行為;呢啲指控仲未經法庭裁決。
Moonshot AI 嘅財務增長非常驚人。2024 年 12 月,公司估值大約係 43 億美元 。到 2026 年 5 月,佢哋喺由美團旗下創投基金領投嘅一輪融資中籌得約 20 億美元,估值超過 200 億美元
。2026 年 6 月,佢哋開始尋求新一輪融資,目標估值 300 億美元
。喺 Kimi K3 推出後幾星期,《彭博》報道 Moonshot 準備喺 8 月開始討論最後一輪上市前融資,估值高達 500 億美元
。公司正積極考慮喺香港上市;早喺 2026 年 3 月,佢哋已經同中金公司同高盛進行過洽談
。市場需求太過強勁,Moonshot 甚至要暫停新嘅 Kimi 訂閱,因為容量唔夠
。
現有嘅搜索結果入面,冇任何經核實嘅報道係關於 Moonshot AI 聲稱 K3 可以「喺最少人類監督下運作」。呢個陳述似乎係一個冇根據嘅元素——喺已搜集嘅材料中,冇足夠證據去確認或描述呢個講法。
另外,雖然特朗普政府對中國 AI 實施出口管制嘅大背景喺公開報道中已經好清楚,但關於政府係咪正在積極考慮將特定中國 AI 實驗室(包括 Moonshot)加入實體清單,呢個問題喺今次搜索中未能用最新嘅來源核實。