竞争局面相当微妙,多个独立来源提供了相互印证的证据。
K3击败了GPT-5.5和Claude Opus 4.8。 在综合基准测试中,Kimi K3得分约为80.96,而GPT-5.5约为73.51,在9个基准测试类别中赢得了7个 。南华早报和CNBC均报道K3“持续超越”GPT-5.5
。它还在多个基准测试中击败了Anthropic的中端旗舰模型Claude Opus 4.8
。
K3仍落后于真正的领先者。 在综合智能方面,K3落后于Anthropic的Claude Fable 5和OpenAI的GPT-5.6 Sol。在“人工智能分析智能指数”上,Claude Fable 5得分为60,GPT-5.6 Sol得分为59,而Kimi K3得分为57.1 。月之暗面自己也承认这一差距
。
K3在智能体编程基准测试中占据主导地位。 这是K3真正大放异彩的领域。它在6个真实世界的智能体编程基准测试中直接赢得了5个,并在前端编程的Arena基准测试中夺得第一,领先于Fable 5 。在“设计Arena”中,K3得分1,679分,高于Fable 5的1,631分和GPT-5.6 Sol的1,618分
。
2026年2月,Anthropic正式指控DeepSeek、月之暗面和MiniMax使用“蒸馏”技术,非法从其Claude模型中提取能力 。根据Anthropic的说法,这三家中国实验室涉嫌设立了超过24,000个欺诈性账户,并与Claude进行了超过1600万次对话以窃取训练数据
。仅月之暗面一家就产生了超过340万次交互,专门针对Claude的智能体推理、工具使用和编程能力
。
2026年6月,Anthropic又在美国参议院银行委员会的一封信中单独指控月之暗面的投资方阿里巴巴,称其进行了一场“明目张胆的”和“非法的”提取运动,涉及25,000个虚假账户和2880万次交互 。
月之暗面尚未公开承认有任何不当行为;这些指控目前仍悬而未决。
月之暗面的财务轨迹非同寻常。2024年12月,该公司估值约为43亿美元 。到2026年5月,它在一轮由美团旗下创投基金领投的融资中筹集了约20亿美元,估值超过200亿美元
。2026年6月,它开始以300亿美元的估值寻求新一轮融资
。在Kimi K3发布仅数周后,彭博社报道称,月之暗面准备在2026年8月开始商讨以高达500亿美元估值进行IPO前最后一轮融资
。香港IPO正在积极考虑中;该公司早在2026年3月就已与中金公司和高盛进行了洽谈
。市场需求如此之大,以至于月之暗面因产能紧张而暂时暂停了新的Kimi订阅
。
在现有的搜索结果中,没有经过核实的报道支持月之暗面关于K3以“最少人类监督”运行的声明。这似乎是一个未经证实的主张——在来源材料中缺乏足够证据来确认或描述此类说法。
此外,虽然特朗普政府对华AI出口管制的大背景已在公开报道中得到充分证实,但在此次搜索中,未能通过最新的内联来源核实美国政府是否正在积极考虑将特定中国AI实验室(包括月之暗面)列入“实体清单”。