中國AI公司Z.ai(原智譜AI)於2026年8月14日推出GLM 5.3,這是一款7400億參數的開源權重模型,在CyberGym資安評測中獲得84.5%的成績,略高於Anthropic的Mythos 5(83.8%)和OpenAI的GPT 5.6 Sol(83.6%)。 GLM 5.3的程式碼能力較前代提升約50%,並在實際測試中於269個開源專案裡發現了2,436個已確認的漏洞,其中1,097個屬於嚴重或高風險等級。
研究答案

Create a landscape editorial hero image for this Studio Global article: What are the key capabilities and benchmark results of Chinese AI firm Zhipu's newly launched GLM-5.3 model, particularly in cybersecurity t. Article summary: On August 14, 2026, Zhipu AI (now branding as **Z.ai**) launched **GLM-5.3**, a 740-billion-parameter open-weight model that delivers roughly 50% better coding performance than GLM-5.2 and unexpectedly strong emergent cy. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
2026年8月14日,中國AI公司智譜AI(現以國際品牌 Z.ai 營運)正式推出 GLM-5.3。這款擁有7400億參數的開源權重模型,不僅在程式碼能力上比前一代GLM-5.2提升了約50%,更意外展現出極強的網路安全能力,其強大程度甚至讓公司決定將開源權重的公開釋出延後兩週,以進行更全面的安全測試 。
GLM-5.3最受矚目的成績來自 CyberGym 評測。該評測由加州大學柏克萊分校的「負責任AI發展倡議」設計,旨在測試模型是否能從白箱原始碼中辨識並驗證真實的漏洞 。在此項評測中,GLM-5.3獲得了 84.5% 的成績,微幅領先 Anthropic 的 Mythos 5 (83.8%) 和 OpenAI 的 GPT-5.6 Sol (83.6%)
。
然而,在更需要深度推理能力的 ExploitBench 評測上,情況則有所不同。ExploitBench 考驗模型是否能理解漏洞的根本原因,並實際產出可運作的攻擊程式。GLM-5.3 的成績雖較前代倍增,從 24.4% 提升至 54.4% ,但 Z.ai 公佈的數據顯示,Mythos 5 在此項評測中獲得 78%,GPT-5.6 Sol 則為 76.5%,GLM-5.3 仍有一段不小的差距
。
在 ExploitGym 評測中,該評測計算模型在標準化的兩小時預算內能完成多少項入侵任務,GLM-5.3 完成了 105 項任務(GLM-5.2 為 29 項)。若將預算延長至六小時,則可完成 130 項任務
。
| 評測項目 | 評測內容 | GLM-5.3 | Anthropic Mythos 5 | OpenAI GPT-5.6 Sol |
|---|---|---|---|---|
| CyberGym | 從原始碼發現並驗證漏洞 | 84.5% | 83.8% | 83.6% |
| ExploitBench | 找出根本原因並產出可運作的攻擊程式 | 54.4% | 78% | 76.5% |
| ExploitGym (2小時預算) | 在標準化預算下完成入侵任務 | 105 項 | 未公佈 | 未公佈 |
除了評測之外,GLM-5.3 在實際的資安測試中也表現出色:
GLM-5.3 在程式碼與 AI 代理(Agent)相關的評測上也表現強勁,確立了其在軟體工程領域中領先開源模型的地位:
Z.ai 表示,模型在後期訓練(post-training)階段,其網路安全能力的「成長速度超出預期」。必須強調的是,模型的 7400 億參數基礎模型 並未重新訓練,所有能力的提升皆來自於後期訓練的改良
。由於這項能力是「湧現性」的,並非公司原先設定的目標,因此 Z.ai 決定將開源權重的釋出延後兩週,以便強化安全與控制措施
。目前該模型已可透過 Z.ai API 以及與 ZCode、Claude Code、OpenCode 的整合來使用
。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
中國AI公司Z.ai(原智譜AI)於2026年8月14日推出GLM 5.3,這是一款7400億參數的開源權重模型,在CyberGym資安評測中獲得84.5%的成績,略高於Anthropic的Mythos 5(83.8%)和OpenAI的GPT 5.6 Sol(83.6%)。
中國AI公司Z.ai(原智譜AI)於2026年8月14日推出GLM 5.3,這是一款7400億參數的開源權重模型,在CyberGym資安評測中獲得84.5%的成績,略高於Anthropic的Mythos 5(83.8%)和OpenAI的GPT 5.6 Sol(83.6%)。 GLM 5.3的程式碼能力較前代提升約50%,並在實際測試中於269個開源專案裡發現了2,436個已確認的漏洞,其中1,097個屬於嚴重或高風險等級。
所有評測數據皆由Z.ai自行公佈,尚未經過獨立驗證。GLM 5.3在CyberGym上的領先優勢不到一個百分點,且在更困難的ExploitBench評測中,仍大幅落後於Mythos 5和GPT 5.6 Sol。