Pada 14 Agustus 2026, Z.ai (sebelumnya Zhipu AI) meluncurkan GLM 5.3, model open weight dengan 740 miliar parameter yang mencetak 84,5% di CyberGym — unggul tipis atas Anthropic Mythos 5 (83,8%) dan OpenAI GPT 5.6 Sol... GLM 5.3 menunjukkan peningkatan 50% dalam performa coding dibandingkan pendahulunya dan menemuka...
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What are the key capabilities and benchmark results of Chinese AI firm Zhipu's newly launched GLM-5.3 model, particularly in cybersecurity t. Article summary: On August 14, 2026, Zhipu AI (now branding as **Z.ai**) launched **GLM-5.3**, a 740-billion-parameter open-weight model that delivers roughly 50% better coding performance than GLM-5.2 and unexpectedly strong emergent cy. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Pada 14 Agustus 2026, Zhipu AI — yang kini melakukan rebranding internasional sebagai Z.ai — meluncurkan GLM-5.3, sebuah model open-weight dengan 740 miliar parameter yang memberikan peningkatan performa coding sekitar 50% lebih baik dari GLM-5.2 dan, yang mengejutkan, memiliki kemampuan keamanan siber emergent yang kuat . Model ini sangat mahir dalam menemukan dan mengeksploitasi celah keamanan sehingga Z.ai menunda rilis publik bobot (weights)nya selama dua minggu untuk pengujian keamanan tambahan
.
Hasil utama GLM-5.3 ada di CyberGym, sebuah benchmark dari Inisiatif Pengembangan AI yang Bertanggung Jawab milik UC Berkeley yang menguji kemampuan model untuk mengidentifikasi dan memvalidasi kerentanan nyata dari kode sumber white-box . Di sana, GLM-5.3 mencetak 84,5%, unggul tipis atas Mythos 5 (83,8%) milik Anthropic dan GPT-5.6 Sol (83,6%) milik OpenAI
.
Gambaran berubah di ExploitBench, yang membutuhkan penalaran lebih dalam tentang bagaimana kerentanan nyata benar-benar dapat dieksploitasi dan menuntut pembuatan eksploit yang berfungsi. GLM-5.3 lebih dari dua kali lipat skor pendahulunya, naik dari 24,4% menjadi 54,4% . Namun, Z.ai melaporkan bahwa Mythos 5 mencetak 78% di ExploitBench dan GPT-5.6 Sol mencetak 76,5% — membuat GLM-5.3 tertinggal jauh pada metrik yang lebih sulit ini
.
Di ExploitGym, yang menghitung berapa banyak tugas eksploitasi yang dapat diselesaikan model dalam anggaran dua jam yang dinormalisasi, GLM-5.3 menyelesaikan 105 tugas (naik dari 29 untuk GLM-5.2) . Dalam anggaran enam jam, angka itu naik menjadi 130 tugas
.
| Benchmark | Apa yang Diukur | GLM-5.3 | Anthropic Mythos 5 | OpenAI GPT-5.6 Sol |
|---|---|---|---|---|
| CyberGym | Penemuan & validasi kerentanan white-box dari kode sumber | 84,5% | 83,8% | 83,6% |
| ExploitBench | Penalaran akar masalah + menghasilkan eksploit yang berfungsi | 54,4% | 78% | 76,5% |
| ExploitGym (anggaran 2 jam) | Penyelesaian eksploitasi dalam anggaran yang dinormalisasi | 105 tugas | Tidak diungkapkan | Tidak diungkapkan |
Di luar benchmark, GLM-5.3 telah digunakan dalam pengujian keamanan dunia nyata dengan hasil yang mengesankan:
GLM-5.3 juga mencatatkan angka-angka kuat pada benchmark coding dan agentic, memposisikannya sebagai model open-weight terdepan untuk tugas-tugas rekayasa perangkat lunak:
Z.ai mengatakan kemampuan keamanan siber model "tumbuh lebih cepat dari yang diantisipasi" selama pasca-pelatihan . 740 miliar parameter model dasar tidak dilatih ulang — semua peningkatan berasal dari perbaikan pasca-pelatihan
. Karena kemampuan tersebut merupakan kejutan yang muncul, perusahaan menahan rilis open-weight selama dua minggu sambil memperkuat kontrol keamanan dan keselamatan
. Model ini sudah tersedia melalui API Z.ai dan melalui integrasi dengan ZCode, Claude Code, dan OpenCode
.
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Pada 14 Agustus 2026, Z.ai (sebelumnya Zhipu AI) meluncurkan GLM 5.3, model open weight dengan 740 miliar parameter yang mencetak 84,5% di CyberGym — unggul tipis atas Anthropic Mythos 5 (83,8%) dan OpenAI GPT 5.6 Sol...
Pada 14 Agustus 2026, Z.ai (sebelumnya Zhipu AI) meluncurkan GLM 5.3, model open weight dengan 740 miliar parameter yang mencetak 84,5% di CyberGym — unggul tipis atas Anthropic Mythos 5 (83,8%) dan OpenAI GPT 5.6 Sol... GLM 5.3 menunjukkan peningkatan 50% dalam performa coding dibandingkan pendahulunya dan menemukan 2.436 kerentanan di 269 proyek open source, termasuk 1.097 kerentanan kritis atau severity tinggi.
Semua skor benchmark dilaporkan sendiri oleh perusahaan dan belum diverifikasi independen.