كان Ox Alpha الاسم التجريبي المجهول لنموذج Z.ai المعروف الآن باسم GLM 5.3 Flash، وقد أكدت الشركة هويته في 26 أغسطس 2026. أوقف النموذج مؤقتًا هيمنة DeepSeek التي استمرت 56 يومًا على ترتيب OpenCode، واستقطب طلبًا استثنائيًا، لكن نتائج DeepSWE الكاملة وضعته أقرب إلى Claude Opus 4.8 من كونها دليلًا قاطعًا على تفوقه على...
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What is the anonymous AI model “Ox Alpha” (or “Niu Lai”), launched quietly on OpenRouter and OpenCode on August 20, 2026 and offered free fo. Article summary: Ox Alpha was a short anonymous “stealth” preview, not a still-unidentified new lab model: Z.ai subsequently identified it as GLM-5.3-Flash, a GLM-family model. Its strong early agentic-coding showing and unusually genero. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
كان Ox Alpha معاينة مجهولة وقصيرة العمر لنموذج GLM-5.3-Flash من عائلة نماذج GLM التابعة لشركة Z.ai. ظهر في 20 أغسطس 2026 على منصتي OpenRouter وOpenCode، تحت اسم مزود الخدمة المجهول «Stealth»، مع نافذة سياق تبلغ 1,048,576 رمزًا، ودعم إدخال النصوص والصور والفيديو، واستدعاء الأدوات، وإتاحة مجانية خلال فترة المعاينة. وأكدت Z.ai لاحقًا أنها اختبرت النموذج سرًا بالاسم ox-alpha قبل إطلاقه باسمه الرسمي. 110
تحولت القصة إلى حالة لافتة توضّح كيف يمكن للتوزيع الواسع، والوصول السخي منخفض التكلفة، والقدرات المصممة للمهام الوكيلة أن تجعل نموذجًا للذكاء الاصطناعي ظاهرة بين المطورين قبل نشر بطاقة نموذج تقليدية أو سجل رسمي للاختبارات المعيارية.
قدمت القائمة المجهولة Ox Alpha بوصفه نموذج استدلال موجهًا إلى البرمجة، والعمل الوكيلي الممتد، وأحمال الإنتاج. وكانت مواصفاته المعلنة طموحة على نحو غير معتاد بالنسبة إلى نموذج تجريبي مجاني:
stealth/ox-alphaاختلفت المنصتان في وصف مدة الإتاحة المجانية. فقد أشارت OpenRouter إلى فترة أقصر مرتبطة بمسارها، بينما تحدثت OpenCode عن إتاحة تمتد نحو أسبوع بدءًا من 20 أغسطس. لذلك كان 24–27 أغسطس حدًا تقريبيًا لانتهاء المسارات المجانية، لا موعدًا واحدًا معلنًا للجميع. 2412
ولا يعني امتلاك سياق يبلغ مليون رمز أن النموذج أفضل تلقائيًا، لكنه يوسع نطاق المهام التي يستطيع المطورون تجربتها. فوكيل البرمجة يمكنه الاحتفاظ بجزء أكبر من مستودع الشيفرة، ومخرجات الأدوات، والسجلات، والسياق البصري في جلسة واحدة، بدل تلخيص المعلومات أو التخلص منها باستمرار. كما جعل دعم الفيديو Ox Alpha مناسبًا لاختبار الواجهات وسير العمل الذي يتجاوز توليد الشيفرة النصية وحده. 343
كان جاذب Ox Alpha عمليًا أكثر منه مجرد قصة غامضة. فقد تمكن المطورون من تجربة نموذج برمجة متعدد الوسائط، طويل السياق، ويدعم الأدوات، من دون تكلفة على الرموز ومع حدود إتاحة سخية نسبيًا. خفّض ذلك عتبة التجربة، خصوصًا أمام مطوري الوكلاء الذين يختبرون إصلاح المستودعات، والتفاعل مع المتصفحات، ومهام هندسة البرمجيات الممتدة.
ارتفعت شعبية النموذج بسرعة. فقد أوقف مؤقتًا سلسلة DeepSeek التي استمرت 56 يومًا في صدارة أحد تصنيفات OpenCode، كما تحدثت تقارير عن قفزة استثنائية في الطلب خلال يوم واحد. لكن ادعاءات الاستخدام التي انتشرت أثناء الإطلاق، ومنها أرقام ضخمة للطاقة الاستيعابية وعدد الرموز، لم تخضع كلها لتدقيق مستقل؛ لذا من الأفضل قراءتها بوصفها مؤشرًا على شدة الاهتمام، لا قياسات دقيقة لحجم الإنتاج. 114
وهنا تظهر نقطة مهمة: شعبية النموذج خلال تجربة مجانية تقيس مزيجًا من القدرة والحداثة والسعر والتوافر. ولا تثبت وحدها أن النموذج هو الأقوى إجمالًا.
كان الادعاء الأكثر تداولًا في البداية هو تحقيق 80% في DeepSWE، استنادًا إلى اجتياز 8 مهام من أصل عينة مؤلفة من 10 مهام. وهذه إشارة مشجعة، لكن 10 مهام عدد قليل جدًا لبناء ترتيب مستقر في قائمة متصدري الاختبارات. وأفادت عملية تقييم أكبر بنتيجة تقارب 63%، بينما أعلنت Z.ai لاحقًا رقمًا رسميًا قدره 63.4% في DeepSWE v1.1 لنموذج GLM-5.3-Flash. 7634
وأظهرت تقييمات أخرى شملت التشغيل الكامل نتائج أقل، من بينها 58.4% في 113 مهمة. ونسب ذلك التقييم جزءًا مهمًا من الإخفاقات إلى مشكلات في تنسيق المخرجات والتنفيذ، وهو ما يوضح مدى حساسية اختبارات الوكلاء لإعدادات بيئة الاختبار، وإتاحة الأدوات، والمهلة الزمنية، ومعايير النجاح. 4142
وعليه، فإن الخلاصة الأكثر إنصافًا أضيق من العنوان الفيروسي: أظهر Ox Alpha قدرة قوية في البرمجة الوكيلة، ووصل في بعض التقييمات إلى مستوى قريب من نماذج مغلقة رائدة، لكن الأدلة لا تثبت أنه تجاوز Claude Fable 5 باستمرار أو تفوق على كل نماذج القمة.
استخدمت المقارنات مجموعات مختلفة من المهام، وبنى مختلفة للوكلاء، وظروف تقييم غير متطابقة. فقد تؤدي عينة مبكرة من 10 مهام إلى نتيجة 80% من دون أن تكون ممثلة للاختبار الكامل. أما التشغيل الأكبر الذي اقترب من 63% فيحكي قصة مختلفة، في حين قد تعكس نتيجة 58.4% خصومات إضافية بسبب تنسيق المخرجات أو سلوك بيئة الاختبار.
وبحسب تقارير لاحقة، رأى فريق DeepSWE أن القدرة العامة للنموذج أقرب إلى مستوى Claude Opus 4.8 منها إلى كونها دليلًا قاطعًا على تجاوزه Claude Fable 5. 35 لذلك ينبغي عرض أرقام الاختبارات مع نطاقها وإعداداتها، لا التعامل معها كأنها نتائج متبادلة على ترتيب واحد واضح.
انسجم حماس المستخدمين المعروفين مع طبيعة النموذج العملية. فقد وصف Patrick Collison أداء Ox Alpha بأنه «مثير للإعجاب جدًا» بعد استخدامه عبر بيئة لتشغيل الوكلاء، بينما قال مؤسس HermesAgent إن النموذج تجاوز عدة معايير داخلية اعتمدها فريقه. 3335
وتكتسب هذه الانطباعات قيمة بوصفها تقارير عن فائدة الاستخدام المباشر، ولا سيما في مهام البرمجة والوكلاء. لكنها لا تعادل استنتاجًا مضبوطًا عبر اختبارات متعددة يفيد بأن Ox Alpha كان متفوقًا على الجميع. فقد يكون نموذج ما مفيدًا بصورة خاصة في سير عمل معين بفضل طول السياق، أو طريقة استدعاء الأدوات، أو السرعة، أو دعم الوسائط، أو التكلفة، حتى لو ظل موقعه الإجمالي في الاختبارات غير محسوم.
قبل الكشف الرسمي، قارن الباحثون سلوك Ox Alpha المرصود بنماذج محتملة من فريق MiMo التابع لـXiaomi، وGoogle DeepMind، وZhipu AI.
بدت Xiaomi احتمالًا معقولًا جزئيًا لأن فريق MiMo سبق أن استخدم اختبارًا مجهولًا باسم «Hunter Alpha». لكن تقارير أشارت إلى اختلاف في القدرات: فقد ارتبطت نماذج MiMo بدعم الصوت، بينما كان Ox Alpha يقبل النصوص والصور والفيديو، ولا يقبل الصوت. لذلك ظل احتمال Xiaomi مثيرًا للاهتمام، لكنه لم يكن إسنادًا قويًا. 2229
أثارت تلميحات ومنشورات مرتبطة بـGoogle مزيدًا من التكهنات، لكن الأدلة المتاحة لم تثبت أن DeepMind طوّر نقطة الوصول أو شغّلها. وظلت تلك الإشارات قرائن ظرفية لا دليلًا على الهوية.
كانت أقوى فرضية قبل الكشف تشير إلى عائلة GLM التابعة لـZhipu. فقد أفادت اختبارات المجتمع بأن أعداد الرموز التي ينتجها Ox Alpha تطابقت مع سلوك GLM-5.3 عبر مطالبات متنوعة، باستثناء إزاحة ثابتة ظاهرة تبلغ نحو 75 رمزًا. كما وجدت اختبارات منفصلة للفيديو سلوكًا متطابقًا في استهلاك الرموز مع نماذج GLM البصرية عبر عدة خصائص للترميز. 1821
وشملت القرائن الأخرى التي أُبلغ عنها:
reasoning_effort يشبه استجابة واجهة GLM البرمجية؛كان من الممكن أن تنتج كل قرينة بمفردها عن التوجيه، أو الأغلفة البرمجية، أو البنية التحتية المشتركة، أو التقليد. لكن اجتماعها جعل فرضية GLM أكثر إقناعًا، من دون أن يحل محل التصريح الرسمي. وجاء الدليل الحاسم عندما عرّفت Z.ai Ox Alpha بأنه GLM-5.3-Flash، ووثقت إطلاق النموذج باسمه المعروف. 1043
حوّل الكشف Ox Alpha من لغز متعلق بالهوية إلى معاينة لمنتج واضح. وتصف وثائق Z.ai نموذج GLM-5.3-Flash بأنه نموذج هجين يضم 320 مليار معلمة إجمالًا و18 مليار معلمة نشطة، إلى جانب قدرات بصرية أصلية تتيح له مراقبة الواجهات، ورؤية النتائج المعروضة، وقراءة ملاحظات التفاعل. 43
كما عالج الإطلاق الرسمي أكبر نقاط ضعف نقطة الوصول المجهولة: عدم اليقين بشأن الاستمرارية. وذكرت تقارير أن GLM-5.3-Flash أُطلق بموجب رخصة MIT، مع إتاحة الأوزان للمطورين الذين يريدون تحكمًا أكبر في النشر. 1950
لكن ذلك لا يعني أن كل عملية نشر ستكون آمنة أو منخفضة التكلفة تلقائيًا. فما زال على المطورين تقييم متطلبات العتاد، وأداء الاستدلال، وشروط واجهة البرمجة، وآلية التعامل مع الخصوصية، وحدود المعدل، وموثوقية استدعاء الأدوات، واتساق المخرجات بما يناسب أعباء العمل الخاصة بهم.
جلبت المعاينة المجانية الاهتمام، لكن تبني النموذج على المدى الطويل سيتوقف على عوامل أكثر استدامة:
الدرس المركزي من قصة Ox Alpha ليس أن نموذجًا مجهولًا تفوق لفترة وجيزة على منافس شهير. الأهم أن نموذجًا مصممًا حول سير عمل مقنع يمكن أن ينتشر بسرعة عندما يستطيع المطورون اختباره على نطاق واسع. كانت قصة الاختبارات أكثر تعقيدًا مما أوحت به العناوين الأولى، لكن المزيج الأساسي — السياق الطويل، وتعدد الوسائط، واستخدام الأدوات، والبرمجة الوكيلة، والوصول منخفض التكلفة — كان قويًا بما يكفي لتبرير كل هذا الاهتمام. وبعد حسم الهوية لصالح GLM-5.3-Flash، أصبح الاختبار الحقيقي هو: هل يظل هذا المزيج مفيدًا بعدما تتراجع حداثة النموذج وتنتهي جاذبية الوصول المجاني؟
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
كان Ox Alpha الاسم التجريبي المجهول لنموذج Z.ai المعروف الآن باسم GLM 5.3 Flash، وقد أكدت الشركة هويته في 26 أغسطس 2026.
كان Ox Alpha الاسم التجريبي المجهول لنموذج Z.ai المعروف الآن باسم GLM 5.3 Flash، وقد أكدت الشركة هويته في 26 أغسطس 2026. أوقف النموذج مؤقتًا هيمنة DeepSeek التي استمرت 56 يومًا على ترتيب OpenCode، واستقطب طلبًا استثنائيًا، لكن نتائج DeepSWE الكاملة وضعته أقرب إلى Claude Opus 4.8 من كونها دليلًا قاطعًا على تفوقه على Claude Fable 5.
يحافظ GLM 5.3 Flash على عناصر الجذب الأساسية: قدرات بصرية أصلية، وبنية هجينة بإجمالي 320 مليار معلمة و18 مليار معلمة نشطة، وأوزان مرخصة بموجب MIT تتيح الاستضافة الذاتية.