Moonshot AI 于 2026 年 7 月 16 日发布 Kimi K3,这是史上最大的开源权重 AI 模型(2.8 万亿参数),在 Artificial Analysis 智能指数 v4.1 上排名全球第三,仅次于 Claude Fable 5 和 GPT 5.6 Sol,但 Moonshot 承认其综合性能仍落后于前两者。 Kimi K3 在 6 个真实世界 Agent 基准测试中一举拿下 5 项第一,包括 DeepSWE(73.0)、BrowseComp(91.2)和 Automation Bench(75.6),在 Arena 盲测中登顶前端开发排行榜(1,679 分),超越 Fable 5 和 GPT 5.6...

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What is the significance of Moonshot AI's July 2026 release of the Kimi K3, a 2.8 trillion-parame. Article summary: Here is the fact-checked assessment based on the available evidence. I was able to **confirm** most of your claims with strong sources, but **could not independently verify the stock market / IPO specifics** within the s. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
2026 年 7 月 16 日,总部位于北京的 Moonshot AI 发布了 Kimi K3,这是一个 2.8 万亿参数的混合专家(MoE)开源权重模型,立即成为有史以来最大的开源权重 AI 模型 。发布时机的选择颇具深意:紧随其后的是在上海举办的世界人工智能大会,而该模型的定位则是直接挑战 OpenAI 和 Anthropic 的最强系统
。发布后仅 48 小时,K3 的需求便如此火爆,以至于 Moonshot 因 GPU 算力几近耗尽而不得不暂停新用户订阅
。这一发布也震动了全球市场,《海峡时报》等媒体指出 K3 “加剧了科技股抛售”,波及美国半导体和 AI 股票
。
本文将讲述这次发布背后的故事——该模型的实际能力、定价策略,以及它在中美 AI 竞争中所代表的里程碑意义。
Kimi K3 在独立的 Artificial Analysis 智能指数 v4.1 上取得了 57.1 分,位列 全球第三,仅次于 Claude Fable 5 (60 分) 和 GPT-5.6 Sol (59 分) 。约 3 分的差距按历史标准来看已非常接近,但差距依然存在:在最为广泛的智能测试中,美国顶级模型仍占优势
。Moonshot 自身也坦承,K3 在总体综合表现上“仍然落后于”Anthropic 和 OpenAI 最强大的专有模型
。
然而,在特定、真实世界的 Agent 基准测试中,K3 实现了超越:
| 基准测试 | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol | Claude Opus 4.8 |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 88.3 | 84.6 | 88.8 | 84.6 |
| DeepSWE | 73.0 | 70.0 | 67.5 | 59.0 |
| BrowseComp | 91.2 | 88.0 | 90.4 | 84.3 |
| Automation Bench | 75.6 | — | — | — |
| SpreadsheetBench 2 | 34.8 | 34.7 | 32.4 | 31.6 |
在这 5 项 Agent 基准测试以及 Program Bench(77.8 分)上,K3 直接拿下了 6 项中的 5 项,在特定测试中击败了 Fable 5 和 GPT-5.6 Sol 。同时,它在所有已发布的基准测试中均大幅超越了 Claude Opus 4.8——这一结果意义重大,因为 Opus 4.8 的定价为输入 5 美元/输出 25 美元(每百万 token),是 K3 的直接成本竞争对手
。
在加州大学伯克利分校研究人员构建的 Arena 盲测人类偏好平台上,K3 在发布后不久即登顶编码排行榜 。Arena 的众包评估显示,K3 在前端 Web 开发榜单上以 1,679 分获得第一,领先于 Fable 5 (1,631 分) 和 GPT-5.6 Sol (1,618 分)
。
在 GPU 内核优化方面——这是改善 AI 模型与硬件交互效率的技术——Moonshot 报告称 K3 “大幅超越”了 Opus 4.8、GPT-5.6 Sol 和 GPT-5.5 。这项能力的商业价值在于,更好的内核优化意味着在相同的硬件上能实现更低的延迟和更高的吞吐量。
该模型采用稀疏 MoE 架构,拥有 896 个专家模块,但每个 token 仅激活其中 16 个,这使得其推理成本与 GPT-5.6 Sol 大致相当,尽管其总参数高达 2.8 万亿 。它还引入了 Kimi Delta Attention (KDA) 和 Attention Residuals (AttnRes)——旨在改进长上下文推理能力的新型架构组件
。
Kimi K3 在市场上最具颠覆性的一个方面是其 API 定价,相较于顶级美国模型有显著优势:
| 模型 | 输入 (每百万 tokens) | 输出 (每百万 tokens) |
|---|---|---|
| Kimi K3 | $3.00 | $15.00 |
| GPT-5.6 Sol | $5.00 | $30.00 |
| Claude Fable 5 | $10.00 | $50.00 |
| Claude Opus 4.8 | $5.00 | $25.00 |
按标价计算,Kimi K3 的成本比 GPT-5.6 Sol 低约 40%,比 Claude Fable 5 低约 70% 。这三个模型清晰地形成了一个 3.3 倍的价格阶梯:Fable 5 的输入和输出价格均为 Kimi K3 的 3.3 倍,GPT-5.6 Sol 则几乎正好处于两者之间
。
此外,K3 的缓存命中输入价格为每百万 token 0.30 美元——比缓存未命中时便宜 10 倍——适用于之前已被处理过的上下文查询 。按完成任务计算,K3 的成本估计比美国旗舰模型低 50% 到 65%
。
Moonshot 为 K3 设定的定价标志着一次显著的战略转变:现在它的定价属于前沿模型级别,而非廉价选项 。此前 Kimi 系列模型如 K2.5 和 K2.6 的定价分别为输入 0.60 美元/输出 2.50-4.00 美元(每百万 token),因此 K3 的价格大约是前代产品的 3-4 倍
。然而,与顶级美国模型相比,它依然更便宜,同时在特定的 Agent 任务上提供了相当或更好的性能。
2026 年 7 月 19 日——发布后大约 48 小时——Moonshot AI 宣布暂停 Kimi K3 的新订阅。该公司在 X 上发文称:“Kimi K3 收到的喜爱远超我们的预期,我们的 GPU 已经感受到了压力。在过去 48 小时内,需求已接近我们当前算力的极限” 。
公司表示将优先为现有订阅用户提供算力,同时以最快速度增加容量,并计划分批重新开放订阅名额 。现有用户的完整访问权限不受影响,企业/API 服务也继续正常运转
。
多家媒体指出,这一事件凸显了中国 AI 实验室因美国芯片出口限制而面临的持续算力挑战 。《南华早报》写道,这种情况“凸显了中国 AI 实验室在为全球用户提供服务时所面临的挑战”
。由于模型的完整权重文件要到 7 月 27 日才开放,第三方无法自行部署,这使得 Moonshot 在发布窗口期内成为唯一的推理服务提供商
。
Moonshot 借此暂停机会将会员计划拆分为两个:Kimi Membership(面向 Web、App 和 Work)以及 Kimi Code Membership(专为编码工作流设计),旨在更合理地分配算力资源 。
Kimi K3 的发布不仅影响了 AI 基准测试,还产生了更广的市场涟漪。《海峡时报》直接报道称 K3 “加剧了科技股抛售”,多家媒体将此次发布与美国半导体和 AI 股票的抛售联系起来 。虽然无法在现有资料中独立确认费城半导体指数的具体走向或英伟达的股价变动,但此次抛售的更广泛市场背景已得到充分报道。
在公司层面,路透社于 2026 年 7 月 20 日报道,暂停订阅“正值该公司寻求新一轮融资,有消息人士称其正推进在香港的首次公开募股(IPO)” 。然而,现有资料中没有任何来源确认以 300 亿美元估值为目标的股东决议。路透社的报道提到了 IPO 计划,但未指明具体估值目标
。
Kimi K3 的完整模型权重计划于 2026 年 7 月 27 日 正式向公众开放 。这是一个至关重要的细节,因为这意味着开发者和组织最终可以下载、运行、检查、微调并拥有这个模型,而不仅仅是租用 API
。先开放 API、11 天后再发布开源权重的两步走策略,构成了整个发布的核心形态
。
在开源权重发布之前,开发者可以通过 kimi.com、Kimi API 或 OpenRouter 访问 K3 。该模型兼容 OpenAI SDK,支持工具调用、结构化输出和自动上下文缓存,并拥有 100 万 token 的上下文窗口,且无长上下文附加费
。
尽管如此,本地运行一个 2.8 万亿参数的模型绝非易事。其文件大小估计约为 1.5 TB,建议的硬件配置包括 64 块以上的企业级 NVIDIA H100 GPU 。对于大多数团队来说,API 仍将是实际的访问方式。
Kimi K3 并非那个能在综合智能上取代 GPT-5.6 Sol 或 Claude Fable 5 的模型——Moonshot 自己也是这么说的。但它的意义在于证明了一个开源权重系统可以在特定、具有商业价值的任务上与前沿专有模型竞争,同时成本仅为其几分之一。这是有史以来发布的最大开源权重模型,并且它的真实世界需求之大,足以在两天内压垮一家公司的 GPU 基础设施。
这种组合——在 Agent 基准测试中达到前沿水准的性能、激进的价格策略、开源权重、以及清晰的需求信号——使 K3 成为 AI 领域的一个重要里程碑,无论它在某个排行榜上排第几。
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Moonshot AI 于 2026 年 7 月 16 日发布 Kimi K3,这是史上最大的开源权重 AI 模型(2.8 万亿参数),在 Artificial Analysis 智能指数 v4.1 上排名全球第三,仅次于 Claude Fable 5 和 GPT 5.6 Sol,但 Moonshot 承认其综合性能仍落后于前两者。
Moonshot AI 于 2026 年 7 月 16 日发布 Kimi K3,这是史上最大的开源权重 AI 模型(2.8 万亿参数),在 Artificial Analysis 智能指数 v4.1 上排名全球第三,仅次于 Claude Fable 5 和 GPT 5.6 Sol,但 Moonshot 承认其综合性能仍落后于前两者。 Kimi K3 在 6 个真实世界 Agent 基准测试中一举拿下 5 项第一,包括 DeepSWE(73.0)、BrowseComp(91.2)和 Automation Bench(75.6),在 Arena 盲测中登顶前端开发排行榜(1,679 分),超越 Fable 5 和 GPT 5.6 Sol。
K3 的 API 定价极具竞争力(输入每百万 token 3 美元、输出 15 美元),比 GPT 5.6 Sol 便宜约 40%,比 Claude Fable 5 便宜约 70%。全模型权重计划于 7 月 27 日开源,届时开发者可自由下载、修改和部署。