התשובה הקצרה: Ox Alpha היה GLM-5.3-Flash
תעלומת Ox Alpha נפתרה. המודל לא היה מוצר עצמאי שנותר אנונימי לאורך זמן, אלא גרסת תצוגה מוקדמת ואנונימית של סדרת GLM מבית Z.ai, המוכרת גם בשם Zhipu. הוא הושק ב־20 באוגוסט 2026 ב־OpenRouter תחת המזהה stealth/ox-alpha, וב־26 באוגוסט אישרה Z.ai כי שמו הרשמי הוא GLM-5.3-Flash.
2
5
10
העניין סביבו לא נבע רק מהזהות הסודית. במשך תקופת התצוגה המוקדמת יכלו מפתחים להשתמש ללא תשלום במודל שנועד לתכנות, למשימות סוכנים ולתהליכי עבודה ארוכים. במקביל, בדיקות קהילתיות מוקדמות הצביעו על יכולת מרשימה בעבודת תוכנה אמיתית.
מה היה מיוחד ב־Ox Alpha?
OpenRouter תיארה את Ox Alpha כמודל היסק לתכנות, לעבודה רציפה של סוכנים ולשימושי ייצור. הוא נועד להתמודד עם הנדסת תוכנה ארוכת־טווח, הסקת מסקנות מורכבת ותהליכים המשלבים טקסט ומידע חזותי.
30
39
הנתונים שפורסמו עבור גרסת התצוגה כללו:
- מזהה המודל:
stealth/ox-alpha
- מועד ההשקה: 20 באוגוסט 2026
- חלון הקשר: 1,048,576 טוקנים — כמיליון טוקנים
- פלט מרבי: 131,072 טוקנים
- קלט: טקסט, תמונות וסרטונים
- יכולות נוספות: קריאות לכלים או לפונקציות ופלט מובנה
- מחיר: אפס עבור קלט ופלט בתקופת התצוגה האנונימית
6
12
14
הנתונים האלה מתאימים לעבודה עם מאגרי קוד גדולים, שיחות ארוכות, ניתוח וידאו ואוטומציות מרובות שלבים. עם זאת, חלון הקשר גדול ומחיר אפס אינם הוכחה לכך שהמודל טוב יותר מכל מודל מסחרי בכל משימה. מה שמשך את המפתחים במיוחד היה הביצוע המוקדם שלו במשימות הנדסת תוכנה.
מדוע קראו לו בסין ״牛来״ — Niu Lai?
המילה האנגלית Ox יכולה להתייחס לשור או לבקר, ולכן מפתחים סינים קישרו אותה לסימנית הסינית 牛, שנהגית niu. משם נולד הכינוי 牛来, בתעתיק Niu Lai.
הכינוי נשען גם על סרט אנימציה סיני בשם ״牛来״, שהפך בקיץ 2026 לתופעת רשת. את שם הסרט אפשר לתרגם בקירוב ל״השור מגיע״ או ״הנה בא השור״.
15
חשוב להדגיש: ״Niu Lai״ הוא כינוי אינטרנטי שנוצר בקהילה. זה לא היה השם הרשמי של המודל, ואין בכך כדי להעיד על קשר מוצרי או על קשר של זכויות יוצרים בין המודל לבין הסרט.
14
15
80% ב־DeepSWE: תוצאה מרשימה, אבל לא הכרעה סופית
הנתון שהפך את Ox Alpha לוויראלי הגיע מבדיקה קהילתית מצומצמת. המודל פתר 8 מתוך 10 משימות הנדסת תוכנה אמיתיות במבחן DeepSWE — תוצאה של 80% Pass@1. באותה השוואה מוקדמת קיבלו Claude Fable 5 כ־65% ו־GPT-5.6 Sol כ־52%.
1
3
48
| מודל |
תוצאה מוקדמת בעשר משימות DeepSWE |
| Ox Alpha |
8 מתוך 10 — 80% |
| Claude Fable 5 |
65% |
| GPT-5.6 Sol |
52% |
DeepSWE בוחן אם סוכן AI מסוגל להבין מאגר קוד אמיתי, לאתר תקלה ולהגיש תיקון עובד — ולא רק לפתור תרגיל תכנות מבודד.
49
57 לכן לתוצאה יש משמעות מעשית מסוימת. אבל עשר משימות בלבד אינן מספיקות כדי להכריז שמודל אחד ניצח את כולם: בחירת המשימות, הנחיות הבדיקה, תצורת ההרצה ותהליך ההערכה עשויים להשפיע על התוצאה.
הניסוח המדויק יותר הוא ש־Ox Alpha הציג ביצועים חזקים בסבב מוקדם של עשר משימות, ולא שהוא הוכיח עליונות כוללת.
בהמשך פורסמו דיווחים שלפיהם המודל פתר 63 מתוך 113 משימות במערך DeepSWE המלא והתקרב לרמתו של Claude Opus 4.8.
5 תוצאה כזו משמעותית יותר ממדגם של עשר משימות, אך הדיווחים הפומביים לא פירטו במידה מספקת את תצורת ההערכה ואת פרטי השחזור. לכן יש להתייחס אליה כתוצאה מדווחת, לא כמסקנה עצמאית ומאומתת לחלוטין.
איך הוא הגיע לראש טבלאות השימוש?
Ox Alpha שילב כמה מרכיבים שקשה להתעלם מהם: זהות אנונימית, שימוש חינמי, חלון הקשר של כמיליון טוקנים, קלט של תמונות וסרטונים, ומיתוג כמודל לתכנות ולמשימות סוכנים.
3
6
10
השילוב הזה הקפיץ אותו במהירות לראש טבלאות השימוש של OpenRouter. דיווחים תיארו את ההשקה כאחת הגדולות בתולדות השוק, וציינו כי היקף השימוש בו עבר פי שניים את זה של DeepSeek.
5
10
16
עם זאת, חשוב לא לערבב בין מדדים שונים. דירוגי OpenRouter, דירוגי OpenCode, מספר הסשנים וכמות הטוקנים אינם אותו נתון — ואי אפשר להפוך אותם באופן אוטומטי למספר משתמשים או לדירוג ביצועים.
מה שכן ניתן לקבוע הוא שהחלון החינמי, המפרט הטכני והביצועים המוקדמים יצרו גל חריג של התנסות מצד מפתחים. מנכ״ל Stripe, פטריק קוליסון, אף תיאר את Ox Alpha ברשת החברתית כ״מרשים מאוד״.
59 זו הייתה תגובה בולטת מהתעשייה, אך אינה תחליף להערכה בלתי תלויה של ביצועי המודל.
אילו ראיות קישרו אותו ל־Zhipu עוד לפני החשיפה?
עוד לפני האישור הרשמי ניסו מפתחים לזהות את המקור באמצעות בדיקות קופסה שחורה — בדיקות שבהן רואים את הקלט והפלט, אך לא את המודל עצמו. כמה סימנים הצביעו על Zhipu.
1. פער קבוע של כ־75 טוקנים
חוקרים השוו את ספירת הטוקנים של Ox Alpha לזו של GLM-5.3 במגוון הנחיות. לפי הדיווחים, הספירה המקורית הייתה כמעט זהה, עם פער קבוע של כ־75 טוקנים בלבד.
1
17
כאשר פער כזה נשמר בטקסטים בשפות שונות, בקוד ובאמוג׳י, הסבר סביר הוא שמערכת OpenRouter או ספק השירות מוסיפים הנחיית מערכת או מעטפת קבועה. ניתוח קהילתי רחב יותר דיווח על התאמה מדויקת ב־95 מתוך 95 בדיקות.
18
זהו סימן חזק לכך שהמודלים משתמשים באוצר מילים זהה או בשכבת שירות דומה. עם זאת, ספירת טוקנים לבדה אינה מוכיחה שכל משקלי המודל — או כל הארכיטקטורה שלו — זהים.
2. עיבוד הווידאו התאים ל־GLM-5V-Turbo
רמז נוסף הגיע מקלט וידאו. בבדיקות קהילתיות דווח כי צריכת הטוקנים של Ox Alpha ושל GLM-5V-Turbo הייתה זהה פריים־אחר־פריים בכמה סרטונים, עם דפוסי דגימה ורזולוציה דומים.
17
24
התנהגות של מקודד וידאו קשה יותר לחקות באמצעות ניסוח תשובות בלבד, ולכן רבים ראו בכך ראיה מבחינה יותר מסגנון טקסטואלי. גם כאן, מדובר בהסקה חיצונית ממודל קופסה שחורה — לא בתחליף להצהרה רשמית של החברה.
3. שגיאות API והתנהגות הפלט היו דומות
מפתחים דיווחו גם על דמיון בהודעות שגיאה של ה־API, בתגובות להגדרות היסק ובסגנון הפלט של Ox Alpha ושל שירותי GLM.
2
4 כאשר הצירוף הזה נוסף להתאמות בטוקנייזר ובעיבוד הווידאו, ההשערה שמדובר במודל קדם־השקה של Zhipu נעשתה משכנעת מאוד.
הטענה שלפיה קיימת ״ודאות של 99%״ הייתה הערכה של צופה מסוים, ולא הסתברות סטטיסטית שנבדקה בשיטה פומבית.
27 רמיזות זהירות של גורמים הקשורים ל־Google DeepMind אף הזינו ספקולציות על Gemini, אך הן לא שינו את התוצאה: ב־26 באוגוסט אישרה Z.ai כי Ox Alpha שייך לסדרת GLM, וחשפה אותו בשם GLM-5.3-Flash.
5
10
Ox Alpha היה חלק מדפוס רחב יותר של השקות Stealth
Ox Alpha לא היה המודל האנונימי הראשון שהופיע ב־OpenRouter. מקרים קודמים שיוחסו לאחר מכן לחברות שונות כללו:
- Pony Alpha → Zhipu GLM-5
- Hunter Alpha → Xiaomi MiMo-V2-Pro
- Elephant Alpha → Inclusion AI של Ant Group
- Owl Alpha → LongCat-2.0 של Meituan
3
8
33
במקרים האלה חוזר דפוס דומה: מודל נפתח לזמן קצר תחת שם קוד אנונימי או חצי־אנונימי, לרוב ללא תשלום, מפתחים משתמשים בו בסביבה אמיתית — ורק לאחר מכן נחשף המותג או השם המסחרי.
34
38
ההיגיון האסטרטגי האפשרי ברור, אף שלא כל חברה אישרה אותו במפורש:
- הפחתת הטיית המותג והמוצא. משתמשים מתנסים במודל לפני שהם יודעים מי בנה אותו.
- איסוף משוב מהעולם האמיתי. מפתחים משלבים את המודל במאגרי קוד, בכלים ובאוטומציות — מעבר למבחני מעבדה סגורים.
- יצירת הפצה אורגנית. השילוב של חינם, אנונימיות וביצועים גבוהים מעודד ניסויים ושיח ברשת.
- בדיקת תשתית בקנה מידה גדול. עומס אמיתי מאפשר לבחון תפוקה, הקשר ארוך ויציבות במשימות סוכנים.
אלה הסברים סבירים לאסטרטגיה, אך לא עובדות שכל יצרניות המודלים הצהירו עליהן. במקרה של Ox Alpha, התצוגה האנונימית אכן הובילה לשימוש נרחב, לניתוח טכני ולעניין מצד מפתחים ברחבי העולם — ולאחר מכן Z.ai חיברה את המודל למותג GLM הרשמי שלה.
8
9
10
השורה התחתונה: לא האנונימיות, אלא שיטת ההשקה
הסיפור של Ox Alpha מתחלק לשני שלבים: בתחילה הוא היה מודל OpenRouter חינמי, רב־מודאלי ובעל חלון הקשר ארוך, שזהותו אינה ידועה; לאחר 26 באוגוסט הוא הפך למוצר מזוהה של Z.ai בשם GLM-5.3-Flash.
2
10
הציון המוקדם של 80% ב־DeepSWE מראה שהמודל היה תחרותי מאוד בקבוצה מסוימת של משימות הנדסת תוכנה. הוא אינו מוכיח עליונות בכל תחום, במיוחד לאור המדגם הקטן והפרטים החלקיים של ההערכה המלאה.
המשמעות ארוכת־הטווח עשויה להיות דווקא מודל ההשקה: תצוגה אנונימית יכולה לשמש בו־זמנית לניסוי ציבורי, לבדיקת תשתית, לאיסוף משוב ולבניית קהל משתמשים לפני חשיפה רשמית.
עבור מפתחים, המבחן החשוב ביותר נשאר מעשי: להריץ את המודל על מאגרי הקוד, כלי העבודה וגבולות המידע שלהם — ולא להסתמך רק על טבלת דירוג או על ציון ויראלי יחיד. הקהילה הצליחה לזהות את הכיוון באמצעות טביעות אצבע טכניות, אך הפרשה גם מזכירה להבחין בין הסקה בסבירות גבוהה לבין אישור רשמי.