كان Ox Alpha نموذج GLM 5.3 Flash من Zhipu AI، وقد تأكدت هويته في 26 أغسطس 2026 بعد اختبار مجاني مجهول بدأ في 20 أغسطس. يستهدف GLM 5.3 Flash البرمجة والبرمجة البصرية والمهام الوكيلة طويلة الأمد، مع نافذة سياق تبلغ 1,048,576 رمزاً، ودعم أصلي للنصوص والصور والفيديو والملفات، وأوزان مفتوحة بترخيص MIT.
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What is Zhipu AI’s GLM-5.3-Flash—the model previously released anonymously on OpenRouter as “Ox Alpha”—and how did its August 20, 2026 blind. Article summary: GLM-5.3-Flash is Zhipu AI’s (Z.ai’s) open-weight, natively multimodal mixture-of-experts model—the system anonymously trialed as “Ox Alpha” before Zhipu identified it on August 26. It is designed chiefly for coding, GUI/. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
ظهر نموذج ذكاء اصطناعي غامض باسم Ox Alpha على منصات وأدوات للمطورين في 20 أغسطس 2026، من دون اسم شركة أو بطاقة نموذج أو مواصفات تفصيلية. وبعد أسبوع تقريباً، كشفت Zhipu AI، التي تعمل دولياً باسم Z.ai، أن النموذج لم يكن إلا نسخة الاختبار المجهولة من GLM-5.3-Flash. 3
4
حوّل الكشف عن الهوية تجربةً سرية استمرت أياماً إلى إطلاق بارز في عالم النماذج المفتوحة: نموذج خليط من الخبراء (MoE) يضم 320 مليار مُعامل إجمالاً، مع تفعيل 18 مليار مُعامل فقط لكل رمز، ونافذة سياق تبلغ نحو مليون رمز، وقدرات متعددة الوسائط مدمجة، وأوزان منشورة بترخيص MIT. 3
6
8
وصل Ox Alpha إلى OpenRouter وOpenCode وأدوات أخرى بوصفه نقطة وصول مجانية مجهولة المصدر. ورصد المطورون دعماً للسياقات الطويلة والمدخلات متعددة الوسائط، ثم بدأوا باستخدامه في البرمجة والمهام الوكيلة. وسرعان ما أثارت جودة مخرجاته العملية تساؤلات حول المختبر الذي يقف وراءه. 13
16
قالت Zhipu إن إخفاء هوية النموذج كان مقصوداً. فبدلاً من ترك اسم الشركة أو عدد المُعاملات أو حملات الإطلاق يؤثر في الانطباعات، أرادت أن يقيّم المطورون النظام من خلال أدائه الفعلي. كما أتاحت التجربة للشركة جمع أنماط استخدام وملاحظات من أعباء عمل حقيقية في تطوير البرمجيات والمهام الوكيلة قبل الإطلاق الرسمي. 13
15
وتحدثت تقارير عن قدرة مجانية تقارب 100 تريليون رمز يومياً خلال فترة الاختبار. كما ذُكر أن باتريك كوليسون، الشريك المؤسس لشركة Stripe، وصف النموذج بأنه «مثير للإعجاب جداً». ساعدت هذه التفاعلات في تحويل نقطة الوصول المجهولة إلى إطلاق يتابعه عدد واسع من المطورين، لكن الحماس العام لا يعادل تقييماً مضبوطاً ومستقلاً. 13
14
وأفادت Zhipu أيضاً بأن الخدمة عملت على مسرّعات ذكاء اصطناعي صينية الصنع. وذكرت صحيفة South China Morning Post أن الاختبار استخدم عنقوداً يضم 100 ألف شريحة من هذا النوع، وأن النموذج عالج 62 تريليون رمز قبل إطلاقه رسمياً. وتختلف هذه الأرقام عن تقديرات أخرى لسعة الاختبار واستخدامه، لذلك ينبغي التعامل معها باعتبارها أرقاماً نقلتها الشركة أو وسائل الإعلام، لا قياسات مدققة بصورة مستقلة. 7
13
GLM-5.3-Flash هو نموذج خليط من الخبراء، أو MoE. ويبلغ إجمالي مخزونه 320 مليار مُعامل، لكن 18 ملياراً فقط تُفعّل عند معالجة كل رمز. الفكرة العملية هي الحصول على القدرة التمثيلية لنموذج ضخم، من دون تشغيل كامل عدد المُعاملات في كل خطوة من خطوات الاستدلال. 3
4
يتكون النموذج من 45 طبقة، وتقدمه Zhipu بوصفه أول نموذج متعدد الوسائط أصلياً في سلسلة GLM-5. وهو مصمم للتعامل مع النصوص والصور والفيديو والوثائق المرئية والملفات والمدخلات المختلطة بين أكثر من وسيط. وتهم هذه القدرة في الحالات التي يحتاج فيها الوكيل إلى فحص واجهة، أو فهم لقطة شاشة، أو قراءة مستند، أو تقييم نتيجة تنفيذ كود، بدلاً من الاكتفاء بالنص. 4
11
وتعلن Zhipu عن نافذة سياق تبلغ 1,048,576 رمزاً، أي ما يقارب مليون رمز. وتستهدف هذه السعة مستودعات البرمجيات الكبيرة، وجلسات الوكلاء الممتدة، ومجموعات الوثائق الضخمة، وسير العمل الذي يجمع بين الكود والصور والملفات والسياق البصري. 3
4
دُرّب النموذج من قاعدة جديدة وبنية معمارية ووصفة تدريب معادتي التصميم. وتقول Zhipu إنه اعتمد على مجموعة بيانات متعددة الوسائط تضم 30 تريليون رمز، ما يعني أن GLM-5.3-Flash يُطرح كنموذج جديد يركز على الكفاءة والقدرات متعددة الوسائط، وليس مجرد نسخة أصغر من GLM-5.3. 4
16
يجمع النموذج بين الانتباه الخطي والانتباه المتناثر. ويهدف الانتباه الخطي إلى جعل معالجة التسلسلات الطويلة أقل كلفة، بينما يحافظ الانتباه المتناثر بصورة انتقائية على التفاعلات عالية الدقة في المواضع الأكثر أهمية. وبهذا تحاول البنية تحقيق توازن بين دعم السياق الطويل وتكاليف الاستدلال القابلة للإدارة. 4
16
وتصف Zhipu كذلك آلية IndexPool لتقليل عبء الذاكرة وزمن الوصول المرتبط بفهرسة السياقات الطويلة. كما تتضمن البنية وصلات فائقة مقيدة بالتشعب (Manifold-Constrained Hyper-Connections) بوصفها تقنية أخرى لتحسين كفاءة التوسع. وهذه تقنيات على مستوى التنفيذ، ولذلك تعتمد فائدتها الحقيقية على إعدادات الخدمة، وطول التسلسل، والعتاد، ونوع أعباء العمل. 4
16
وبالمقارنة مع GLM-5.3، تقول Zhipu إن GLM-5.3-Flash يخفض حسابات الانتباه بمقدار 3.01 مرات، واستخدام ذاكرة التخزين المؤقت للمفاتيح والقيم (KV-cache) بمقدار 4.44 مرات، مع الحفاظ على جودة السياق الطويل. وتهم هذه الادعاءات المطورين لأن حسابات الانتباه وذاكرة KV-cache قد تتحول إلى عنق زجاجة رئيسي في الوكلاء الذين يعملون لفترات طويلة. غير أن هذه النسب مستمدة أساساً من المواد التقنية الخاصة بـZhipu، ولا ينبغي اعتبارها تحسناً عالمياً مثبتاً بصورة مستقلة في كل بيئة تشغيل. 4
يركز GLM-5.3-Flash على البرمجة، والبرمجة البصرية، ومهام الوكلاء طويلة الأمد، واستخدام الأدوات. وتتيح له قدراته البصرية الأصلية مراقبة الواجهات ونتائج العرض والتغذية الراجعة الناتجة عن التفاعل، بما يخلق حلقة متصلة بين الكود والمتصفحات وواجهات المستخدم الرسومية. 4
وتشمل نتائج الاختبارات التي أعلنتها Zhipu ما يلي:
تدعم هذه النتائج تموضع النموذج في مجالي هندسة البرمجيات والوكلاء، لكن المقارنات تحتاج إلى حذر. فقد تتغير نتائج اختبارات الوكلاء بدرجة كبيرة تبعاً للتعليمات، والأدوات، والبنية المساعدة، والعتاد، والحدود الزمنية، وإصدار التقييم. لذلك تُفهم الأرقام المنشورة باعتبارها نتائج أعلنتها Zhipu، لا ترتيباً نهائياً مستقلاً بين جميع النماذج المنافسة. 4
15
نشرت Zhipu أوزان GLM-5.3-Flash على Hugging Face بترخيص MIT المتساهل، بما في ذلك إصدار BF16. كما تشير وثائق النموذج إلى دعم أطر تشغيل مثل SGLang وvLLM، ما يمنح المؤسسات خيار التشغيل المحلي أو الاستضافة الذاتية، بدلاً من الاعتماد حصراً على واجهة Z.ai السحابية. 3
6
8
ويغير هذا الانفتاح المعادلة العملية للمطورين. إذ يمكن اختبار النموذج على مستودعاتهم ووثائقهم وواجهاتهم البصرية وبيئات الوكلاء الخاصة بهم، كما تستطيع فرق البنية التحتية دراسة تكاليف الخدمة ومتطلبات العتاد مباشرة. ومع ذلك، فإن إجمالي 320 مليار مُعامل يجعل نشر النموذج مهمة هندسية كبيرة؛ فتفعيل 18 مليار مُعامل لكل رمز يقلل العمل الحسابي، لكنه لا يجعل نقطة التحقق الكاملة خفيفة تلقائياً.
لم تكن تجربة Ox Alpha مجرد حيلة دعائية. فقد اختبرت ما إذا كان المطورون سيواصلون استخدام النموذج عندما تُحجب هويته وعدد مُعاملاته وانتماؤه المؤسسي. ومنحت التجربة Zhipu شكلاً مفيداً من ملاحظات المنتج، لأن المستخدمين قدموا أعباء عمل فعلية وانطباعاتهم قبل الكشف الرسمي. 13
15
لكن للتجربة حدوداً واضحة. فالوصول المجاني قد يجذب حركة استخدام استثنائية، وقد يعكس المديح العلني أثر الجِدة، كما أن الاختبار المجهول لا يضبط التعليمات ولا يضمن مقارنة جميع الأنظمة في ظروف متطابقة. وعليه، فإن الخلاصة الأقوى والأكثر تحفظاً هي أن GLM-5.3-Flash اجتذب اهتماماً كبيراً من المطورين قبل معرفة هويته، وأن Zhipu استخدمت هذا التفاعل لاختبار الإطلاق وصقل رسالته.
GLM-5.3-Flash هو الاسم الذي كُشف لاحقاً لنموذج Ox Alpha: نموذج GLM مفتوح الأوزان ومتعدد الوسائط أصلياً، صُمم للبرمجة والعمل الوكيلي بكفاءة. ومن أبرز مواصفاته بنية MoE تضم 320 مليار مُعامل إجمالاً و18 مليار مُعامل نشط لكل رمز، و45 طبقة، ونافذة سياق تبلغ مليون رمز، وانتباه هجيناً خطياً ومتناثراً، وأوزاناً بترخيص MIT. 3
4
11
ولا تكمن أهم وعود النموذج في الحجم وحده، بل في جمع السياق الطويل والمدخلات البصرية واستخدام الأدوات مع خفض مزعوم لتكاليف الخدمة، ضمن نموذج يستطيع المطورون تنزيله وتشغيله بأنفسهم. وقد وفر الإطلاق المجهول ملاحظات واقعية لافتة، لكن التقييمات المستقلة والقابلة لإعادة الإنتاج تظل ضرورية لمعرفة كيف تنعكس هذه الادعاءات المعمارية ونتائج الاختبارات على الأداء في بيئات الإنتاج.
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
كان Ox Alpha نموذج GLM 5.3 Flash من Zhipu AI، وقد تأكدت هويته في 26 أغسطس 2026 بعد اختبار مجاني مجهول بدأ في 20 أغسطس.
كان Ox Alpha نموذج GLM 5.3 Flash من Zhipu AI، وقد تأكدت هويته في 26 أغسطس 2026 بعد اختبار مجاني مجهول بدأ في 20 أغسطس. يستهدف GLM 5.3 Flash البرمجة والبرمجة البصرية والمهام الوكيلة طويلة الأمد، مع نافذة سياق تبلغ 1,048,576 رمزاً، ودعم أصلي للنصوص والصور والفيديو والملفات، وأوزان مفتوحة بترخيص MIT.
تقول Zhipu إن تصميمه الهجين، الذي يجمع بين الانتباه الخطي والمتناثر، يخفض حسابات الانتباه 3.01 مرات واستخدام ذاكرة KV cache بمقدار 4.44 مرات مقارنةً بـGLM 5.3، لكن هذه الأرقام تحتاج إلى اختبارات مستقلة.