Moonshot AI 在2026年7月16日發布 Kimi K3,一個2.8兆參數的混合專家(MoE)開源模型,在 Artificial Analysis Intelligence Index v4.1 排名全球第三,僅次於 Claude Fable 5 及 GPT 5.6 Sol 模型在 DeepSWE(73.0)、BrowseComp(91.2)及 Automation Bench(75.6)等五個真實代理基準奪冠,Moonshot 承認總體智能「仍落後」頂級美國專有模型 完整模型權重預計在2026年7月27日開放下載,K3 將成為開發者可以自由下載及修改的最大開源模型

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What is the significance of Moonshot AI's July 2026 release of the Kimi K3, a 2.8 trillion-parame. Article summary: Here is the fact-checked assessment based on the available evidence. I was able to **confirm** most of your claims with strong sources, but **could not independently verify the stock market / IPO specifics** within the s. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
2026年7月16日,北京 Moonshot AI 發布咗 Kimi K3,一個 2.8 兆參數嘅混合專家(MoE)開源重量模型,即刻成為史上最大型嘅開源 AI 模型。發佈時間好刻意:揀正上海世界人工智能大會之前,個模型擺明車馬挑戰 OpenAI 同 Anthropic 嘅頂級系統
。48 個鐘之內,K3 嘅需求勁到 Moonshot 要暫停新用戶訂閱,因為 GPU 容量已經頂唔順
。呢個發佈仲震散埋環球市場,《海峽時報》話 K3 「引發咗科技股跌勢」
。
以下就係呢次發佈嘅詳細分析 — 個模型事實上做到啲咩、點樣收費、點解代表住中美 AI 競賽嘅一個重要時刻。
Kimi K3 喺獨立嘅 Artificial Analysis Intelligence Index v4.1 攞到 57.1 分,全球排第三,落後 Claude Fable 5(60 分)同 GPT-5.6 Sol(59 分)。差距大約 3 分 — 以歷史標準嚟講算好窄,但好清楚:最廣泛嘅智能測試仍然偏好頂級美國模型
。Moonshot 自己都承認,K3 「總體效能仍然落後」Anthropic 同 OpenAI 嘅最強專有模型
。
但 K3 喺具體、真實嘅代理基準上反而領先:
| 基準測試 | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol | Claude Opus 4.8 |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 88.3 | 84.6 | 88.8 | 84.6 |
| DeepSWE | 73.0 | 70.0 | 67.5 | 59.0 |
| BrowseComp | 91.2 | 88.0 | 90.4 | 84.3 |
| Automation Bench | 75.6 | — | — | — |
| SpreadsheetBench 2 | 34.8 | 34.7 | 32.4 | 31.6 |
喺呢五個代理基準加 Program Bench(77.8),K3 贏咗 6 個之中嘅 5 個,喺呢啲特定測試上擊敗咗 Fable 5 同 GPT-5.6 Sol 。佢仲 喺每個已發布嘅基準上大幅拋離 Claude Opus 4.8 — 呢個結果好有意義,因為 Opus 4.8 嘅定價係每百萬 tokens 輸入 $5、輸出 $25,直接係成本競爭對手
。
喺由 UC Berkeley 研究人員建立嘅 Arena 盲測平台,K3 喺發布後短時間內就登頂編程排行榜 。Arena 嘅群眾比較評估顯示,K3 喺前端網頁開發攞到 1,679 分,排第一,領先 Fable 5(1,631)同 GPT-5.6 Sol(1,618)
。
喺 GPU 核心優化 — 即係改善 AI 模型同硬件互動嘅技術 — Moonshot 匯報 K3 「大幅超越」Opus 4.8、GPT-5.6 Sol 同 GPT-5.5 。呢個喺商業上好緊要,因為更好嘅核心優化意味住同一硬件上有更低延遲同更高吞吐量。
呢個模型採用 稀疏 MoE 架構,有 896 個專家,每次只激活 16 個,因此雖然總參數達 2.8 兆,推論成本同 GPT-5.6 Sol 差唔多 。佢仲引入 Kimi Delta Attention(KDA) 同 Attention Residuals(AttnRes) — 係新嘅架構組件,用嚟改善長上下文推理能力
。
Kimi K3 其中一個最顛覆市場嘅地方係 API 定價,比頂級美國模型平一大截:
| 模型 | 輸入(每百萬 tokens) | 輸出(每百萬 tokens) |
|---|---|---|
| Kimi K3 | $3.00 | $15.00 |
| GPT-5.6 Sol | $5.00 | $30.00 |
| Claude Fable 5 | $10.00 | $50.00 |
| Claude Opus 4.8 | $5.00 | $25.00 |
Kimi K3 比 GPT-5.6 Sol 平大約 40%,比 Claude Fable 5 平大約 70%。呢三個模型形成一條好清楚嘅 3.3 倍階梯:Fable 5 嘅輸入輸出價格係 Kimi K3 嘅 3.3 倍,GPT-5.6 Sol 就夾喺中間
。
另外,K3 嘅 快取命中輸入率係 $0.30 每百萬 tokens — 比快取未命中率平 10 倍 — 用於之前已經服務過嘅上下文查詢 。以每個任務計,K3 估計比美國旗艦模型 平 50-65%
。
Moonshot 對 K3 嘅定價係一個明顯轉變:佢而家定價似一個前沿模型,而唔係平價選項 。之前嘅 Kimi 模型好似 K2.5 同 K2.6 定價係 $0.60 輸入 / $2.50-4.00 輸出,所以 K3 比自己嘅前代貴大約 3-4 倍
。不過,佢仍然比頂級美國模型平,同時喺特定代理任務上提供可比擬甚至更好嘅表現。
2026 年 7 月 19 日 — 發布後大約 48 小時 — Moonshot AI 宣布 暫停 Kimi K3 新用戶訂閱。公司喺 X 出 post:「Kimi K3 得到嘅愛遠超我哋預期,我哋嘅 GPU 感受到壓力。過去 48 小時,需求已經接近我哋目前容量嘅極限」。
公司話會優先將算力分配畀現有訂閱用戶,同時盡快增加容量,計劃分批重新開放訂閱名額 。現有用戶保留完整使用權限,企業同 API 服務亦不受影響
。
多間傳媒指出,呢件事 凸顯咗中國因美國晶片出口限制而長期面對嘅算力制約 。《南華早報》話,呢個情況「突顯咗中國 AI 實驗室向全球用戶提供服務所面臨嘅挑戰」
。模型嘅完整權重要到 7 月 27 日先開放,等第三方可以喺自己硬件上運行 — 意味住發布初期 Moonshot 係唯一嘅推論容量提供者
。
Moonshot 利用今次暫停,將會員計劃拆分為兩種:Kimi Membership(用於網頁、App 同 Work)同 Kimi Code Membership(用於編程工作流程),呢個重組目的係更好咁分配算力資源 。
Kimi K3 嘅發布喺 AI 基準之外都引起漣漪效應。《海峽時報》直接話 K3 「引發咗科技股跌勢」,多間傳媒將呢次發布同美國半導體同 AI 股嘅拋售聯繫起來 。雖然喺現有資料集中未能獨立確認費城半導體指數嘅具體走向或 Nvidia 嘅股價變動,但整體嘅市場背景係有充分記載嘅。
喺企業層面,路透社喺 2026 年 7 月 20 日報導,呢次訂閱暫停「正值公司尋求新一輪融資,消息人士話佢哋正準備喺香港進行首次公開招股」。不過,現有證據入面冇來源確認到一個具體嘅股東決議或 300 億美元嘅估值目標。路透社嘅報導只係提到 IPO 計劃,冇講明目標估值
。
Kimi K3 嘅完整模型權重預計喺 2026 年 7 月 27 日 公開 。呢個係一個關鍵細節:代表開發者同機構最終可以 下載、運行、檢查、微調同擁有 呢個模型,而唔係純粹透過 API 租嚟用
。呢個兩步走嘅策略 — 先開放 API,11 日後再開放權重 — 就係成個發布嘅形狀
。
喺開源權重發布之前,開發者可以透過 kimi.com、Kimi API 或者 OpenRouter 使用 K3 。呢個模型兼容 OpenAI SDK,支援工具呼叫、結構化輸出同自動上下文快取,仲有 100 萬 tokens 嘅上下文窗口,冇長上下文附加費
。
不過,要本地運行一個 2.8 兆參數嘅模型並唔簡單。檔案大小估計大約 1.5 TB,建議硬件包括 64 塊或以上企業級 NVIDIA H100 GPU 。對大多數團隊嚟講,API 仍然係實際嘅接入點。
Kimi K3 並唔係一個喺整體智能上推翻 GPT-5.6 Sol 或者 Claude Fable 5 嘅模型 — Moonshot 自己都係咁講。但佢係一個證明開源權重系統可以喺特定、有商業價值嘅任務上同前沿專有模型競爭嘅模型,而且成本只係對方嘅一個零頭。佢係史上最大型嘅開源權重模型,而且帶住足夠嘅真實世界需求,兩日之內就逼爆咗一間公司嘅 GPU 基礎設施。
呢個組合 — 喺代理基準上達到前沿水平嘅表現、進取嘅定價、開源權重,同埋一個清晰嘅需求訊號 — 令 K3 成為 AI 領域一個重要嘅里程碑,無論佢喺任何單一排行榜上排第幾。
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Moonshot AI 在2026年7月16日發布 Kimi K3,一個2.8兆參數的混合專家(MoE)開源模型,在 Artificial Analysis Intelligence Index v4.1 排名全球第三,僅次於 Claude Fable 5 及 GPT 5.6 Sol
Moonshot AI 在2026年7月16日發布 Kimi K3,一個2.8兆參數的混合專家(MoE)開源模型,在 Artificial Analysis Intelligence Index v4.1 排名全球第三,僅次於 Claude Fable 5 及 GPT 5.6 Sol 模型在 DeepSWE(73.0)、BrowseComp(91.2)及 Automation Bench(75.6)等五個真實代理基準奪冠,Moonshot 承認總體智能「仍落後」頂級美國專有模型
完整模型權重預計在2026年7月27日開放下載,K3 將成為開發者可以自由下載及修改的最大開源模型