ב 14 באוגוסט 2026 השיקה Z.ai (לשעבר Zhipu AI) את GLM 5.3, מודל עם 740 מיליארד פרמטרים בקוד פתוח למחצה, המשיג 84.5% במבחן CyberGym עוקף את Mythos 5 של אנתרופיק (83.8%) ואת GPT 5.6 Sol של OpenAI (83.6%) בזיהוי פרצות אבטחה. המודל סיפק שיפור של כ 50% בביצועי קוד לעומת הדור הקודם ואיתר 2,436 פרצות אבטחה מאומתות ב 269 פרו...
Research answer

Create a landscape editorial hero image for this Studio Global article: What are the key capabilities and benchmark results of Chinese AI firm Zhipu's newly launched GLM-5.3 model, particularly in cybersecurity t. Article summary: On August 14, 2026, Zhipu AI (now branding as **Z.ai**) launched **GLM-5.3**, a 740-billion-parameter open-weight model that delivers roughly 50% better coding performance than GLM-5.2 and unexpectedly strong emergent cy. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
ב-14 באוגוסט 2026 השיקה Zhipu AI, הפועלת כעת תחת המותג הבינלאומי Z.ai, את GLM-5.3 - מודל עתיר פרמטרים (740 מיליארד) בקוד פתוח למחצה, המציג שיפור של כ-50% בביצועי קוד לעומת GLM-5.2 ויכולות אבטחת סייבר מתפתחות ומפתיעות . היכולת של המודל לאתר ולנצל פרצות אבטחה כה משמעותית עד כי Z.ai החליטה לעכב את שחרור משקלי המודל לציבור בשבועיים לצורך בדיקות בטיחות נוספות
.
ההישג הבולט של GLM-5.3 הוא במבחן CyberGym, מבחן מבית היוזמה לפיתוח AI אחראי של אוניברסיטת ברקלי, הבודק אם מודל יכול לזהות ולאמת פרצות אבטחה אמיתיות מתוך קוד מקור . שם, GLM-5.3 משיג ציון של 84.5%, עוקף בפער זעום את Mythos 5 של אנתרופיק (83.8%) ואת GPT-5.6 Sol של OpenAI (83.6%)
.
התמונה משתנה במבחן ExploitBench, הדורש חשיבה מעמיקה יותר לגבי האופן שבו ניתן לנצל פרצה בפועל ודורש פיתוח ניצול (exploit) עובד. GLM-5.3 יותר מכפיל את ציון קודמו, מ-24.4% ל-54.4% . עם זאת, Z.ai מדווחת כי Mythos 5 משיג 78% ב-ExploitBench ו-GPT-5.6 Sol משיג 76.5% - כך ש-GLM-5.3 נותר הרחק מאחור במדד הקשה יותר הזה
.
ב-ExploitGym, המודד כמה משימות ניצול מודל מסוגל להשלים תחת תקציב זמן מתוקנן של שעתיים, GLM-5.3 מסיים 105 משימות (לעומת 29 עבור GLM-5.2) . במסגרת תקציב של שש שעות, המספר עולה ל-130 משימות
.
| מבחן אמת מידה | מה הוא מודד | GLM-5.3 | Anthropic Mythos 5 | OpenAI GPT-5.6 Sol |
|---|---|---|---|---|
| CyberGym | זיהוי ואימות פרצות (white-box) מקוד מקור | 84.5% | 83.8% | 83.6% |
| ExploitBench | ניתוח סיבת שורש + הפקת ניצול עובד | 54.4% | 78% | 76.5% |
| ExploitGym (תקציב שעתיים) | השלמת משימות ניצול תחת תקציב מתוקנן | 105 משימות | לא פורסם | לא פורסם |
מעבר למבחנים מבוקרים, GLM-5.3 נפרס בבדיקות אבטחה בעולם האמיתי עם תוצאות מרשימות:
GLM-5.3 מפרסם גם מספרים חזקים במבחני קוד וסוכנים (agents), המציבים אותו כמודל מוביל בקטגוריית הקוד הפתוח למחצה למשימות הנדסת תוכנה:
Z.ai מסבירה כי יכולת אבטחת הסייבר של המודל "צמחה מהר יותר מהצפוי" במהלך שלב הפוסט-טריינינג (אימון נוסף לאחר האימון הראשוני) . 740 מיליארד הפרמטרים של מודל הבסיס לא אומנו מחדש - כל השיפורים הגיעו משיפורים בשלב הפוסט-טריינינג
. מכיוון שיכולת זו הייתה הפתעה מתעוררת, החברה מעכבת את שחרור משקלי המודל לציבור בשבועיים כדי לחזק את בקרות הבטיחות והאבטחה
. המודל כבר זמין דרך ה-API של Z.ai ובאמצעות אינטגרציות עם ZCode, Claude Code ו-OpenCode
.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
ב 14 באוגוסט 2026 השיקה Z.ai (לשעבר Zhipu AI) את GLM 5.3, מודל עם 740 מיליארד פרמטרים בקוד פתוח למחצה, המשיג 84.5% במבחן CyberGym עוקף את Mythos 5 של אנתרופיק (83.8%) ואת GPT 5.6 Sol של OpenAI (83.6%) בזיהוי פרצות אבטחה.
ב 14 באוגוסט 2026 השיקה Z.ai (לשעבר Zhipu AI) את GLM 5.3, מודל עם 740 מיליארד פרמטרים בקוד פתוח למחצה, המשיג 84.5% במבחן CyberGym עוקף את Mythos 5 של אנתרופיק (83.8%) ואת GPT 5.6 Sol של OpenAI (83.6%) בזיהוי פרצות אבטחה. המודל סיפק שיפור של כ 50% בביצועי קוד לעומת הדור הקודם ואיתר 2,436 פרצות אבטחה מאומתות ב 269 פרויקטי קוד פתוח, מתוכן 1,097 פרצות קריטיות או חמורות.
כל תוצאות האמת מידה מדווחות על ידי החברה ועדיין לא אומתו באופן בלתי תלוי. היתרון ב CyberGym על פני המתחרים האמריקאים הוא פחות מאחוז אחד, ו GLM 5.3 מפגר הרחק מאחור במבחן ExploitBench (54.4% לעומת 78% ל Mythos 5 ו 76.5%...