智谱AI的GLM 5.2在Artificial Analysis Intelligence Index v4.1上获得51分,成为最高分的开源权重模型,整体排名第四,仅次于Claude Fable 5、Claude Opus 4.8和GPT 5.5。 关键基准测试成绩:FrontierSWE 74.4%、Terminal Bench 2.1(81.0)、SWE bench Pro(62.1)、GPQA Diamond(80.3%)、AIME 2025(86.67%)以及WebDev Arena第一名。
研究答案

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for What is Z.AI's GLM-5.2, how does it perform on the Artificial Analysis Intelligence Index and coding benchm. Article summary: Here is a comprehensive answer covering all the dimensions you asked about.. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evid
2026年6月13日,总部位于北京的智谱AI(Z.AI,原智谱华章)发布了GLM-5.2,一个拥有7530亿参数的开源权重模型。该模型立即在Artificial Analysis Intelligence Index上成为有史以来得分最高的开源权重模型 。它在多个长程编程基准测试中击败了OpenAI的GPT-5.5,而每token成本仅为其约六分之一,这标志着开源AI的一个重要里程碑,也表明中国AI实验室已大幅缩小了与西方专有前沿模型的差距
。
GLM-5.2在Artificial Analysis Intelligence Index v4.1上获得了51分——这是开源权重模型有史以来的最高分 。这使得它在完整排行榜上位列第四,仅次于Claude Fable 5(60分)、Claude Opus 4.8(56分)和GPT-5.5(估计约53-55分)
。它击败了其他中国开源竞争对手:MiniMax-M3(44分)、DeepSeek V4 Pro Max(44分)和Kimi K2.6(43分)
。从GLM-5.1(40分)到GLM-5.2(51分)的版本间提升达到了+11分——这比大多数小版本发布的提升幅度都要大
。
在Artificial Analysis的编程指数上,它获得了68.8分,优于99%的追踪模型 。该模型还位于智能度与每任务成本图表的帕累托前沿,这意味着没有其他开源模型能以更低的每任务成本提供这种能力
。
根据独立评估公司Vals AI的数据,GLM-5.2在五个基准测试中(包含闭源模型)表现最佳:Vals Index、Harvey's Legal Agent Benchmark、Finance Agent v2、ProofBench和Vibe Code Bench 。
GLM-5.2保留了与其前身GLM-5.1相同的744B总参数/40B活跃参数的混合专家(MoE) 设计,但引入了两项重大的架构创新 :
| 项目 | 价格 |
|---|---|
| 输入token | $1.40 |
| 输出token | $4.40 |
| 缓存输入 | $0.26(存储限时免费) |
智谱AI于2025年1月被列入美国实体清单,限制其获取美国先进的半导体和芯片制造设备
。GLM-5.2的发布恰逢美国政府下令关闭Anthropic的Claude Fable服务,一个直接竞争对手
。智谱AI创始人唐杰在发布公告中明确提到了这次关闭,他表示:“我们对某些前沿模型突然受到限制深感遗憾。因非技术原因突然拒绝访问前沿模型,这更加坚定了我们的信念——‘科学应该没有国界’”
。2026年6月15日,智谱AI股价飙升33%,原因是华盛顿收紧了对美国先进模型的外国访问限制后,华尔街加大了对中国AI公司的押注
。
智谱AI于2026年1月8日在香港交易所完成IPO,募集资金约43.5亿港元(约合5.58亿美元),市值接近528.3亿美元 。公司由CEO张鹏领导。
GLM-5.2是最明确的信号,表明中国的开源权重模型已经缩小了与西方专有前沿模型的差距。在多个长程编程基准测试中,它现在已经明确击败了GPT-5.5,并且与Claude Opus 4.8的差距在1%以内 。该模型证明,出口管制并未减缓中国AI实验室在架构创新(如IndexShare)方面和取得有竞争力基准分数方面的能力
。智谱AI的战略结合了开源权重发布(MIT许可证)、激进定价(约为闭源前沿模型成本的1/6)以及对长程智能体编程任务的专注——直接瞄准了西方实验室一直主导的开发者受众
。这次发布引发了一种更广泛的竞争动态:如果中国开源权重模型保持这一发展轨迹,那么西方实验室为闭源访问所收取的价差将变得越来越难以自圆其说,尤其是在对成本敏感的编程和智能体工作负载方面
。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
智谱AI的GLM 5.2在Artificial Analysis Intelligence Index v4.1上获得51分,成为最高分的开源权重模型,整体排名第四,仅次于Claude Fable 5、Claude Opus 4.8和GPT 5.5。
智谱AI的GLM 5.2在Artificial Analysis Intelligence Index v4.1上获得51分,成为最高分的开源权重模型,整体排名第四,仅次于Claude Fable 5、Claude Opus 4.8和GPT 5.5。 关键基准测试成绩:FrontierSWE 74.4%、Terminal Bench 2.1(81.0)、SWE bench Pro(62.1)、GPQA Diamond(80.3%)、AIME 2025(86.67%)以及WebDev Arena第一名。
Vercel CEO Guillermo Rauch和Box CEO Aaron Levie等科技领袖公开称赞该模型。