ظهر Ox Alpha مجاناً ومن دون اسم مطوّر في 20 أغسطس 2026، قبل أن تؤكد Z.ai في 26 أغسطس أنه نموذج GLM 5.3 Flash. يضم النموذج 320 مليار معامل، مع تفعيل 18 مليار معامل فقط لكل رمز، ويدعم سياقاً يصل إلى 1,048,576 رمزاً ومدخلات نصية وصورية وفيديو.
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What is Z.ai’s GLM-5.3-Flash, and how did it resolve the week-long mystery surrounding the anonymously released “Ox Alpha” model—covering it. Article summary: GLM-5.3-Flash is Z.ai (Zhipu AI)’s open-weight, natively multimodal GLM-5 model—and the company confirmed on August 26 that it was the previously anonymous “Ox Alpha.” The reveal turned a six-day public stress test into . Topic tags: general, general web, user generated, documentation, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
على مدى ستة أيام، استخدم مطوّرون نموذجاً قوياً للذكاء الاصطناعي من دون معرفة الجهة التي تقف وراءه. ظهر النموذج باسم Ox Alpha مجاناً ومن دون نسبته إلى شركة على منصتي OpenRouter وOpenCode في 20 أغسطس 2026، مع نافذة سياق تبلغ مليون رمز تقريباً ودعم للنصوص والصور والفيديو. وفي 26 أغسطس، كشفت Z.ai، العلامة الدولية لشركة Zhipu AI، أن Ox Alpha هو GLM-5.3-Flash، أول نموذج متعدد الوسائط أصلي في عائلة GLM-5. 2
5
9
لم يكن الكشف مجرد حلّ للغز تقني؛ فقد حوّل تجربة عامة مجهولة إلى إطلاق منتج. جاء GLM-5.3-Flash بأوزان مفتوحة بموجب ترخيص MIT، وأسعار API منخفضة معلنة، وبنية صُممت لجعل البرمجة ضمن سياقات طويلة ومهام الوكلاء الذكية أقل كلفة. 6
7
9
ظهر النموذج أولاً على OpenRouter وOpenCode من دون اسم مطوّر معلن، وبسعر صفري، وحدّ للسياق يبلغ 1,048,576 رمزاً، مع القدرة على استقبال النصوص والصور والفيديو. وسرعان ما أخضعه المطوّرون لاختبارات عملية شملت وكلاء البرمجة، ومهام الطرفية، وسير العمل الذي يتطلب التعامل مع كميات ضخمة من السياق. 4
5
8
بدأ مجتمع الذكاء الاصطناعي في البحث عن أدلة تكشف هويته. ومن بين المؤشرات التي أُبلغ عنها سلوك يشبه مُرمّزات GLM وأنماط أخطاء في واجهة API، ما دفع مطوّرين إلى ترجيح وقوف Zhipu AI وراء النموذج. ثم أكدت Z.ai بنفسها الصلة في 26 أغسطس، موضحة أن الاختبار المجهول كان يهدف إلى جمع ملاحظات من الاستخدام الواقعي قبل الإطلاق الرسمي. 5
9
ولّدت المعاينة حجماً لافتاً من الاستخدام. فقد أشار تقرير معاصر إلى معالجة 42 تريليون رمز خلال ستة أيام، بينما ذكر تقرير آخر نحو 44 تريليون رمز و503 آلاف مستخدم لـOpenCode. وهذه الأرقام تعود إلى تقارير ونقاط قياس مختلفة، لذلك لا ينبغي جمعها أو التعامل معها كرقم واحد جرى التحقق منه بصورة مستقلة. 8
11
16
GLM-5.3-Flash نموذج ذو أوزان مفتوحة، يركز على البرمجة، والمهام طويلة الأمد التي تنفذها الوكلاء الذكية، وسير العمل متعدد الوسائط. وتصفه Z.ai بأنه أول نموذج متعدد الوسائط أصلي في عائلة GLM-5. وتشمل قدراته المعلنة استقبال المدخلات البصرية ونافذة سياق من مليون رمز، ما يتيح وضع مستودعات برمجية كبيرة ووثائق ولقطات شاشة ومدخلات أخرى ضمن مهمة واحدة. 7
20
ويعتمد النموذج على بنية خليط من الخبراء تضم 320 مليار معامِل إجمالاً، مع تفعيل 18 مليار معامِل لكل رمز. وبعبارة مبسطة، يمتلك النموذج مخزوناً كبيراً من القدرات المتعلَّمة، لكنه لا يمرر كل رمز عبر هذا المخزون بأكمله؛ بل يوجّهه إلى جزء منه فقط. كما تقول Z.ai إنه يجمع بين الانتباه المتناثر والانتباه الخطي لتقليل متطلبات الحوسبة وذاكرة التخزين المؤقت للمفاتيح والقيم أثناء الاستدلال. 6
20
وهنا تأتي دلالة كلمة «Flash»: فالنموذج ليس صغيراً من حيث الحجم الكلي، لكنه يستهدف تكلفة تشغيل أقل من نموذج كثيف يضم العدد نفسه من المعاملات. وقد تقلل هذه البنية كمية الحوسبة المطلوبة لكل رمز، إلا أن السرعة والتكلفة الفعليتين تظلان مرتبطتين بالأجهزة وبرمجيات التشغيل وتجميع الطلبات وطبيعة المهمة.
تقول Z.ai إن GLM-5.3-Flash حقق 63.4 في اختبار DeepSWE v1.1، مقابل 46.2 لنموذج GLM-5.2. كما أعلنت عن مقارنة داخلية مع Claude Opus 4.8 بنتيجة 29.0 مقابل 29.5. 7
8
هذه النتائج تقدم مؤشرات مهمة، لكنها لا تمثل ترتيباً نهائياً شاملاً لجودة النماذج. فنتيجة DeepSWE مطالبة بنتيجة أعلنها المطوّر، أما مقارنة Claude فموصوفة بأنها تقييم داخلي. ويمكن لاختلاف التعليمات والأدوات والبنية المساعدة وطريقة الاختبار واحتمال تلوث بيانات الاختبار أن يؤثر كثيراً في النتيجة. لذلك لا تزال الاختبارات المستقلة القابلة لإعادة الإنتاج ضرورية قبل اعتبار النموذج مكافئاً على نطاق واسع لأي نظام مغلق رائد.
بالنسبة إلى المطوّرين، تكمن الفكرة العملية في ملاءمة النموذج لسير العمل: القدرة على فحص مستودعات كبيرة، والاستفادة من السياق البصري، ومواصلة مهام الوكيل لفترات طويلة من دون ضغط سجل المهمة مراراً. أما الأداء في بيئة الإنتاج فيعتمد على الموثوقية، واستخدام الأدوات، وزمن الاستجابة، والتعامل مع الأخطاء، وليس على نتيجة معيارية واحدة فقط.
أعلنت Z.ai أسعاراً أساسية قدرها 0.15 دولار لكل مليون رمز إدخال و0.50 دولار لكل مليون رمز إخراج. وتعرض وثائقها لاحقاً عرضاً مؤقتاً بخصم 50%، يخفض السعرين إلى 0.075 دولار و0.25 دولار على التوالي خلال الفترة الترويجية المحددة. 2
وأُتيحت أوزان النموذج بموجب ترخيص MIT على Hugging Face، ما يجعل الإصدار أكثر انفتاحاً من نموذج لا يمكن استخدامه إلا عبر خدمة مستضافة. ويسمح ترخيص MIT عموماً بإعادة الاستخدام التجاري والتعديل، لكن على الفرق مراجعة نص الترخيص الفعلي وشروط النموذج والاعتماديات ومتطلبات الأجهزة والالتزامات المرتبطة بكل عملية نشر. 2
9
كما تدرج وثائق Z.ai النموذج ضمن منظومة خطط المطوّرين والبرمجة لديها، بينما يوضح مرجع API أنه يدعم مدخلات المحادثة متعددة الوسائط واستخدام الأدوات. 17
20
21
حمل الإصدار قصة ثانية تتجاوز النموذج نفسه. فقد قالت Z.ai إن معاينة Ox Alpha المجهولة شُغّلت بالكامل على مسرّعات ذكاء اصطناعي صينية الصنع، باستخدام منظومة تشغيل مخصصة مبنية على SGLang. وتعرض مواد الشركة الهندسية هذا النشر باعتباره محاولة لتحسين كفاءة الاستدلال على العتاد المحلي.
وتكرر بعض التقارير الثانوية ادعاءً بأن المنظومة المخصصة رفعت الأداء من طرف إلى طرف ثلاثة أضعاف. لكن مكونات أسطول المسرّعات، والمقارنة الدقيقة للأداء، ومدى استقلال النشر عن المكونات الأجنبية لم تخضع لتدقيق مستقل في المصادر المتاحة هنا. 10
وتكمن أهمية هذا التفصيل في أنه، إذا تأكد، سيحمل دلالة استراتيجية على مساعي الصين لبناء خدمات ذكاء اصطناعي قادرة في ظل قيود تصدير الرقائق الأميركية. أما في الوقت الحالي، فمن الأدق اعتباره إفصاحاً مهماً من الشركة، لا دليلاً حاسماً على أن العتاد المحلي سدّ فجوة البنية التحتية الأوسع.
منحت استراتيجية Ox Alpha شركة Z.ai شيئاً يصعب أن يوفره الإطلاق التقليدي: استخداماً واسع النطاق وفوضوياً من مطوّرين لا يعرفون هوية النموذج. فقد اختبره المستخدمون داخل وكلاء البرمجة ومهام السياق الطويل لأنه كان مجانياً وقادراً بصورة لافتة، لا بسبب ورقة مواصفات تسويقية. وقالت Z.ai إن هدفها كان جمع الملاحظات قبل الإطلاق الرسمي. 5
9
وينسجم هذا الأسلوب أيضاً مع استراتيجية توزيع الأوزان المفتوحة. فمن خلال الجمع بين أوزان مرنة الاستخدام، وأسعار API منخفضة، وإتاحة واسعة للمطوّرين، تستطيع Z.ai تشجيع التجربة وجمع الملاحظات وبناء قاعدة استخدام حول النموذج خارج مسار الاشتراكات التقليدية للنماذج المغلقة. وتشير تجارب سابقة لنماذج مجهولة، من بينها تجربة Pony Alpha التي أُبلغ عنها، إلى أن الفكرة لم تكن معزولة، رغم محدودية التفاصيل المتاحة عنها.
لا يثبت GLM-5.3-Flash وحده أن Z.ai رسخت موقعاً جديداً في قمة الذكاء الاصطناعي. فأقوى ما يقدمه حتى الآن هو مزيج من مواصفات منشورة، ومعاينة عامة ناجحة بصورة غير معتادة، وادعاءات من الشركة بشأن المعايير والبنية التحتية. وستحدد التقييمات المستقلة والاستخدام المستمر في الإنتاج مستوى منافسته في البرمجة والاستدلال متعدد الوسائط واستخدام الأدوات وزمن الاستجابة والموثوقية.
لكن الإشارة التنافسية واضحة. فنموذج يضم نافذة سياق من مليون رمز، ويدعم المدخلات متعددة الوسائط أصلياً، ويتيح أوزاناً مفتوحة، ويقدم API بأسعار تقاس بالسنتات لكل مليون رمز، يضغط على اقتصاديات الأنظمة المغلقة مرتفعة التكلفة. كما يوضح كيف يمكن للمعاينات المجهولة أن تؤدي في الوقت نفسه دور اختبار ضغط واقعي ومحرك لتوزيع المنتج.
انتهى لغز Ox Alpha: كان النموذج هو GLM-5.3-Flash من Z.ai. أما السؤال الأكبر فلم يعد سؤالاً جنائياً عن الهوية، بل سؤالاً عملياً: إلى أي مدى تصمد وعود النموذج منخفض التكلفة وواسع السياق عندما ينتقل المطوّرون من معاينة مجانية انتشرت بسرعة إلى مهام إنتاجية متكررة يمكن الاعتماد عليها؟
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
ظهر Ox Alpha مجاناً ومن دون اسم مطوّر في 20 أغسطس 2026، قبل أن تؤكد Z.ai في 26 أغسطس أنه نموذج GLM 5.3 Flash.
ظهر Ox Alpha مجاناً ومن دون اسم مطوّر في 20 أغسطس 2026، قبل أن تؤكد Z.ai في 26 أغسطس أنه نموذج GLM 5.3 Flash. يضم النموذج 320 مليار معامل، مع تفعيل 18 مليار معامل فقط لكل رمز، ويدعم سياقاً يصل إلى 1,048,576 رمزاً ومدخلات نصية وصورية وفيديو.
أعلنت Z.ai سعراً أساسياً قدره 0.15 دولار لكل مليون رمز إدخال و0.50 دولار لكل مليون رمز إخراج، مع إتاحة الأوزان بموجب ترخيص MIT.