Z.ai(旧智譜AI)が2026年8月14日にリリースしたGLM 5.3は、7400億パラメータのオープンウェイトモデル。サイバーセキュリティベンチマーク「CyberGym」で84.5%を達成し、Anthropic Mythos 5(83.8%)やOpenAI GPT 5.6 Sol(83.6%)を僅差で上回る[4][5][8]。 実環境でのテストでは、269のオープンソースプロジェクトから合計2,436件の脆弱性を発見。うち1,097件が重大または高リスクに分類され、AIコードエディタ「Cursor」の深刻な脆弱性も含まれていた[2][3][8][13]。
研究の答え

Create a landscape editorial hero image for this Studio Global article: What are the key capabilities and benchmark results of Chinese AI firm Zhipu's newly launched GLM-5.3 model, particularly in cybersecurity t. Article summary: On August 14, 2026, Zhipu AI (now branding as **Z.ai**) launched **GLM-5.3**, a 740-billion-parameter open-weight model that delivers roughly 50% better coding performance than GLM-5.2 and unexpectedly strong emergent cy. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
2026年8月14日、中国のAIスタートアップZ.ai(旧・智譜AI)は、最新のオープンウェイトモデル「GLM-5.3」をリリースした。7400億パラメータを誇る本モデルは、前世代GLM-5.2と比較してコーディング性能が約50%向上しただけでなく、予期せぬ強力なサイバーセキュリティ能力を獲得したことで注目を集めている。その能力はあまりに強力で、同社は安全性テストを理由に、重みファイルの公開を通常より2週間遅らせる異例の措置をとっている
。
GLM-5.3の最大のニュースは、UCバークレー校の「責任あるAI開発イニシアチブ」が開発したベンチマーク「CyberGym」での結果だ。このベンチマークは、ホワイトボックス(ソースコードが与えられた状態)で実際の脆弱性を発見・検証できるかをテストする。GLM-5.3はここで84.5%を記録し、AnthropicのMythos 5(83.8%)、OpenAIの**GPT-5.6 Sol(83.6%)**を僅かに上回った。
しかし、評価がより深い推論を必要とする「ExploitBench」に変わると状況は一変する。ここでは脆弱性の根本原因を特定し、実際に機能するエクスプロイトを生成する能力が試される。GLM-5.3は54.4%と前世代から倍増したものの、Mythos 5(78%)やGPT-5.6 Sol(76.5%)には遠く及ばない。
3つ目のベンチマーク「ExploitGym」では、2時間の予算内で完了できるエクスプロイトタスクの数で評価される。GLM-5.3は105タスク(前世代は29)を完了し、6時間に延長すると130タスクに達した。
| ベンチマーク | 測定内容 | GLM-5.3 | Anthropic Mythos 5 | OpenAI GPT-5.6 Sol |
|---|---|---|---|---|
| CyberGym | ソースコードからの脆弱性発見・検証 | 84.5% | 83.8% | 83.6% |
| ExploitBench | 根本原因の推論+動作するエクスプロイト生成 | 54.4% | 78% | 76.5% |
| ExploitGym(2時間) | 予算内でのエクスプロイト完了数 | 105タスク | 非公開 | 非公開 |
ベンチマークだけではない。GLM-5.3は実際のセキュリティテストでも驚くべき成果を上げている。
サイバーセキュリティ以外でも、GLM-5.3はソフトウェアエンジニアリング分野で一流のオープンウェイトモデルとしての地位を確立している。
Z.aiは、ポストトレーニング中にサイバーセキュリティ能力が「予想よりも急速に成長した」と説明している。ベースモデルのパラメータ(7400億)自体には変更がなく、すべての能力向上はポストトレーニングによるものだという
。この能力が創発的で予測不能だったため、同社は安全対策とセキュリティコントロールを強化するために、オープンウェイトのリリースを2週間延期することを決定した
。モデル自体はすでにZ.aiのAPI、およびZCode、Claude Code、OpenCodeとの統合を通じて利用可能である
。
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
Z.ai(旧智譜AI)が2026年8月14日にリリースしたGLM 5.3は、7400億パラメータのオープンウェイトモデル。サイバーセキュリティベンチマーク「CyberGym」で84.5%を達成し、Anthropic Mythos 5(83.8%)やOpenAI GPT 5.6 Sol(83.6%)を僅差で上回る[4][5][8]。
Z.ai(旧智譜AI)が2026年8月14日にリリースしたGLM 5.3は、7400億パラメータのオープンウェイトモデル。サイバーセキュリティベンチマーク「CyberGym」で84.5%を達成し、Anthropic Mythos 5(83.8%)やOpenAI GPT 5.6 Sol(83.6%)を僅差で上回る[4][5][8]。 実環境でのテストでは、269のオープンソースプロジェクトから合計2,436件の脆弱性を発見。うち1,097件が重大または高リスクに分類され、AIコードエディタ「Cursor」の深刻な脆弱性も含まれていた[2][3][8][13]。
ただし、すべてのベンチマーク結果は企業報告によるもので、第三者検証は未実施。また、より難しい「ExploitBench」では54.4%と、Mythos 5(78%)やGPT 5.6 Sol(76.5%)に大きく水をあけられている[6][7][8]