Z.ai'nin yeni modeli GLM 5.3, CyberGym kıyaslamasında %84.5 ile Mythos 5'in (%83.8) ve GPT 5.6 Sol'un (%83.6) önünde yer alarak güvenlik açığı tespitinde en yüksek puanı aldı. Ancak GLM 5.3, ExploitBench'te %54.4'te kalırken, bu alanda Mythos 5 %78.0 ve GPT 5.6 Sol %76.5 puan alarak çok daha başarılı oldu; bu, en te...
Research answer

Create a landscape editorial hero image for this Studio Global article: How does Chinese AI startup Z.ai's open source GLM 5.3 model compare to Anthropic's restricted Mythos 5 model in cybersecurity vulnerability. Article summary: GLM-5.3 claims a narrow lead over Mythos 5 on vulnerability *detection* (84.5% vs 83.8% on CyberGym), but trails significantly on *exploitation* (54.4% vs 78.0% on ExploitBench). Its open-weight release is delayed for sa. Topic tags: general web, ai safety, openai, llm, agents. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts
14 Ağustos 2026'da Z.ai, 743 milyar parametrelik temel model üzerine inşa ettiği açık kaynak modeli GLM-5.3'ü piyasaya sürdü. Model, CyberGym güvenlik açığı tespit kıyaslamasında %84.5'lik bir başarı oranıyla mevcut en iyi sonuca ulaşarak, Anthropic'in kısıtlı erişimli Mythos 5 (%83.8) ve OpenAI'in GPT-5.6 Sol (%83.6) modellerini kıl payı geride bıraktı . Ancak GLM-5.3, gerçek istismar (exploit) geliştirme yeteneklerinde Mythos 5'in oldukça gerisinde kaldı (%54.4 - %78.0). Ayrıca, modelin açık ağırlıklarının yayınlanması bir güvenlik incelemesi nedeniyle ertelendi
. Bu karşılaştırma, tespitte dar bir liderlik ile istismardaki belirgin boşluk, erişim kontrolleri, güvenlik duruşu ve düzenleyici bağlam açısından karmaşık bir tablo ortaya koyuyor.
| Kıyaslama | GLM-5.3 | GLM-5.2 (Önceki Nesil) |
|---|---|---|
| Terminal-Bench 3.0 | 28.3 | 4.6 |
| DeepSWE v1.1 | 66.9 | 46.2 |
| Agents' Last Exam (CLI) | 28.5 | 23.8 |
| Z.ai Dahili Kodlama Kıyaslaması | Yaklaşık %50 iyileşme | Temel seviye |
Not: Mythos 5, SWE-bench Pro (ajanlık kodlama) kıyaslamasında %80.3 puan alıyor ancak bu spesifik kıyaslamalarda her iki model için de doğrudan karşılaştırılabilir veri bulunmuyor . GLM-5.3'ün tüm kazanımları, yalnızca genişletilmiş eğitim sonrası (post-training) aşamadan geldi; 743B temel model yeniden eğitilmedi
.
GLM-5.3, güvenlik açığı tespitinde Mythos 5'in önünde yer alırken (%84.5'e karşı %83.8), istismar geliştirmede geride kalıyor (%54.4'e karşı %78.0). Açık ağırlıklarının yayınlanması güvenlik incelemesi nedeniyle ertelendi ve önceki model GLM-5.2, siber saldırı talimatlarını neredeyse hiç reddetmediği için eleştirildi. Mythos 5, kamuya hiç açılmamış ve yalnızca onaylı ortaklarla sınırlı olmasına rağmen en tehlikeli saldırı görevinde çok daha yetenekli. Daha geniş anlamda, açık ağırlıklı modeller siber görevlerde sınır oluşturan kısıtlı modellerle arasındaki yetenek farkını hızla kapatırken, güvenlik önlemleri hala çok daha zayıf durumda. Çin'in en iyi yapay zeka modellerinin ihracına yönelik belirsiz düzenleyici ortamı, GLM-5.3'ün ağırlıklarının Z.ai'nin pazarlamasının vaat ettiği kadar özgürce kullanıma sunulup sunulmayacağına dair bir başka karmaşıklık katmanı ekliyor.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Z.ai'nin yeni modeli GLM 5.3, CyberGym kıyaslamasında %84.5 ile Mythos 5'in (%83.8) ve GPT 5.6 Sol'un (%83.6) önünde yer alarak güvenlik açığı tespitinde en yüksek puanı aldı.
Z.ai'nin yeni modeli GLM 5.3, CyberGym kıyaslamasında %84.5 ile Mythos 5'in (%83.8) ve GPT 5.6 Sol'un (%83.6) önünde yer alarak güvenlik açığı tespitinde en yüksek puanı aldı. Ancak GLM 5.3, ExploitBench'te %54.4'te kalırken, bu alanda Mythos 5 %78.0 ve GPT 5.6 Sol %76.5 puan alarak çok daha başarılı oldu; bu, en tehlikeli yetenek olan çalışan istismar kodları üretmedeki büyük farkı ortaya...
GLM 5.3'ün açık ağırlıkları henüz yayınlanmadı; güvenlik incelemesi ve sıkılaştırmasının ardından en az iki hafta içinde kullanıma sunulması planlanıyor.