GLM 5.3 是 Z.ai 面向編程與 AI 代理的最新模型,支援 100 萬 token 上下文;Z.ai 表示,它在內部 Z.ai Code Bench 的表現較 GLM 5.2 提升 50%,但部分公開基準數字仍來自第三方報告,尚未獲獨立驗證。[2][6][32] Z.ai 將進步主要歸因於擴大後訓練規模,以及更貼近多日軟體工程與研究流程的任務環境,而非單純增加上下文長度。[2] 目前可透過 Z.ai 的 GLM Coding Plan 與 ZCode 使用 GLM 5.3;開放權重據報預計在 2026 年 8 月 14 日發布後約兩週、完成額外安全評估後推出,時間仍屬暫定。[3][8][12][32]
研究答案

Create a landscape editorial hero image for this Studio Global article: What is Z.ai’s GLM-5.3, how does it compare with GLM-5.2 in coding, long-horizon tasks, cybersecurity, and benchmarks such as Z.ai Code Benc. Article summary: GLM-5.3 is Z.ai’s flagship coding-and-agent model, aimed at complex software engineering and long-horizon tasks. It has a 1M-token context window and is available through Z.ai’s GLM Coding Plan; its API availability was . Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
GLM-5.3 是 Z.ai 最新推出的編程與 AI 代理模型,定位在複雜軟體工程、深度除錯,以及需要長時間持續執行的多步驟任務。Z.ai 列出的上下文視窗為 100 萬 token,並將它描述為比前代 GLM-5.2 更適合長程、複雜工作。
這次更新的重點,不只是傳統編程測試拿到更高分。Z.ai 表示,GLM-5.3 在自家 Z.ai Code Bench 的表現提升 50%,並在 Terminal-Bench 3.0、Agents’ Last Exam(CLI)等公開評測中,達到開放模型的最先進表現。
目前最明確的官方比較,是 Z.ai 宣稱 GLM-5.3 在 Z.ai Code Bench 比 GLM-5.2 提升 50%。至於下表的公開基準數字,則來自第三方貼文整理,應視為發布時的報告結果,而非已獲獨立確認的產業共識:
| 基準測試 | GLM-5.2 | GLM-5.3 | 反映的能力 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | 處理延伸命令列任務的能力明顯提升 |
| DeepSWE v1.1 | 46.2% | 66.9% | 軟體工程任務表現更佳 |
| Agents’ Last Exam(CLI) | 23.8% | 28.5% | 工具使用與代理式工作有所進步 |
| CyberGym | 77.2% | 84.5% | 漏洞發現能力提升 |
| ExploitBench | 24.4% | 54.4% | 報告分數超過 GLM-5.2 的兩倍 |
官方 Z.ai 文件確認了編程、長程任務與資安能力提升的大方向,但在目前提供的資料中,並未逐一重現上述所有細節數字。因此,精確比較仍應等候更多獨立測試。
在這份比較表中,Terminal-Bench 3.0 從 4.6% 跳至 28.3%,是最顯眼的增幅。這項測試與編程代理特別相關,因為模型通常要在命令列環境中管理工具、檢查系統狀態、修改檔案,並在多個階段之間持續推進,而不是只產生一段孤立的程式碼。
現有證據支持 GLM-5.3 在這項測試上的表現大幅優於 GLM-5.2,但不能因此推論它會在每個真實程式碼庫或開發流程中都必然勝出。實際成效仍會受到提示詞、代理框架、工具整合方式與專案類型影響。
GLM-5.3 的主要使用場景,是持續性的工程工作:規劃、實作、除錯,再到反覆修改與驗證。Z.ai 為模型列出 100 萬 token 上下文視窗,並明確將它定位在長程、複雜任務上。
這使它與只針對短篇程式碼提示進行微調的例行更新有所不同。Z.ai 表示,GLM-5.3 在 Terminal-Bench 3.0 和 Agents’ Last Exam(CLI)等長程代理評測中,達到開放模型的最先進表現;自家 Code Bench 則較 GLM-5.2 提升 50%。
對開發團隊而言,實際意義在於模型被設計成能保留並運用更多專案背景,在更多步驟中延續同一項任務。不過,基準分數並不能單獨證明模型的穩定性、成本、延遲,或在特定開發環境中的工具執行品質。若要評估是否遷移,仍應以團隊常用的程式庫與工作流程進行實測,而不是直接把基準提升幅度當成生產環境的等比例提升。
Z.ai 表示,GLM-5.3 在 CyberGym 漏洞發現基準測試中取得目前為止的最佳成績;在漏洞利用方面,模型表現也超過 GLM-5.2 的兩倍。
第三方比較表則稱,CyberGym 從 77.2% 上升至 84.5%,ExploitBench 從 24.4% 增至 54.4%。由於官方提供的資料未獨立重現這些精確數字,現階段較適合將它們視為發布時的報告結果,而非已經定案的產業基準。
這些資安結果有兩層意義。第一,它們顯示模型的代理能力可能不只延伸至撰寫應用程式,也包括尋找漏洞、理解漏洞成因與推理攻擊路徑。第二,模型在漏洞發現與利用方面越強,部署前的安全評估就越重要:它可以協助防禦性資安工作,但若缺乏適當權限管理、監控與使用限制,也可能提高遭到濫用的風險。
Z.ai 將 GLM-5.3 的進步主要歸因於規模化的後訓練。按照公司的說法,團隊擴大了訓練中使用的任務環境,讓它們更接近真實世界中可能持續數日的工程與研究流程,而不只是短小、封閉的編程練習。
換句話說,這次提升被描述為訓練方式與任務環境的改變,而不只是增加上下文視窗,或公布一套全新的基礎架構。這也能解釋為何報告中最明顯的進步出現在長程與代理式評測:後訓練過程的目標,是讓模型學會規劃、使用工具、從失敗中恢復,並在較長任務中持續前進。
但這仍是 Z.ai 對改進來源的說法。這些成果能否跨模型、代理框架、提示詞與不同軟體專案穩定複製,仍需要獨立測試確認。
GLM-5.3 已納入 Z.ai 的 GLM Coding Plan,官方文件表示 Max、Pro 與 Lite 等方案均支援該模型;它也已整合至 ZCode 開發環境。
至於開放權重,現有證據顯示當時尚未公開。第三方報告稱,Z.ai 預計在 2026 年 8 月 14 日發布後約兩週、完成額外安全評估後推出,換算大約是 2026 年 8 月下旬。不過,這個時程只獲第三方資料支持,仍應視為暫定日期,而非已確認的發布承諾。
因此,開發者現階段需要分清楚「可以使用」與「可以重現」是兩回事:GLM-5.3 已能透過 Z.ai 支援的編程產品試用,但在相關權重尚未公開前,外部團隊仍無法完全在本地重現發布時的詳細測試結果。
GLM-5.3 並不是單純更換型號,而是一次針對編程代理的定向升級。Z.ai 報告稱,它在內部編程基準提升 50%,在長程代理評測中取得更強結果,資安相關能力也較 GLM-5.2 顯著增長。
但判讀這次發布時,證據層級同樣重要:Z.ai 官方文件確認了能力提升的方向,精確的公開基準比較與約兩週後推出權重的時程,則主要來自第三方報導,仍待獨立驗證。
在更多測試結果與模型權重正式公開前,GLM-5.3 最適合被理解為一個目前可透過產品使用、前景受到關注的編程代理升級版,而不是已能由外部完整重現的開放模型。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
GLM 5.3 是 Z.ai 面向編程與 AI 代理的最新模型,支援 100 萬 token 上下文;Z.ai 表示,它在內部 Z.ai Code Bench 的表現較 GLM 5.2 提升 50%,但部分公開基準數字仍來自第三方報告,尚未獲獨立驗證。[2][6][32]
GLM 5.3 是 Z.ai 面向編程與 AI 代理的最新模型,支援 100 萬 token 上下文;Z.ai 表示,它在內部 Z.ai Code Bench 的表現較 GLM 5.2 提升 50%,但部分公開基準數字仍來自第三方報告,尚未獲獨立驗證。[2][6][32] Z.ai 將進步主要歸因於擴大後訓練規模,以及更貼近多日軟體工程與研究流程的任務環境,而非單純增加上下文長度。[2]
目前可透過 Z.ai 的 GLM Coding Plan 與 ZCode 使用 GLM 5.3;開放權重據報預計在 2026 年 8 月 14 日發布後約兩週、完成額外安全評估後推出,時間仍屬暫定。[3][8][12][32]