أكدت زيبو للذكاء الاصطناعي في 26 أغسطس 2026 أن نموذج «Ox Alpha» أو «Niu Lai» المجهول هو GLM 5.3 Flash، وهو نموذج مفتوح الأوزان ومتعدد الوسائط أصلاً، مبني على بنية «خليط الخبراء». استقطب الاختبار المجاني المجهول على منصتي OpenRouter وOpenCode أكثر من 50 تريليون رمز خلال خمسة أيام، ثم تجاوزت التقارير 60 تريليون رمز خل...
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What did Zhipu AI reveal on August 26, 2026, about the anonymous “Ox Alpha” model known as “Niu Lai,” including its identity as GLM 5.3 Flas. Article summary: On August 26, Zhipu AI (Z.ai) disclosed that the anonymous “Ox Alpha”/“Niu Lai” model was its GLM 5.3 Flash: an open weight, native multimodal mixture of experts model tested anonymously before release.. Topic tags: general web, ai, productivity, code, api. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, cl
في 26 أغسطس 2026، أنهت شركة زيبو للذكاء الاصطناعي، المعروفة دولياً باسم Z.ai، حالة الغموض حول نموذج الذكاء الاصطناعي الذي ظهر بلا هوية تجارية تحت اسم Ox Alpha، أو «نيو لاي» (牛来) في الأوساط الصينية.
وأكدت الشركة أن النموذج هو GLM-5.3-Flash، وهو نموذج مفتوح الأوزان ومتعدد الوسائط أصلاً، يعتمد على بنية «خليط الخبراء» (Mixture of Experts). وكانت زيبو قد اختبرت النموذج سراً وبصورة مجهولة قبل إطلاقه رسمياً. 1
4
6
ظهر Ox Alpha على منصتي OpenRouter، وهي منصة تجمع نماذج الذكاء الاصطناعي وتتيح الوصول إليها عبر واجهة موحدة، وOpenCode، التي يستخدمها المطورون في مهام البرمجة والوكلاء البرمجيين. وقد أتيح النموذج مجاناً ومن دون شعار الشركة أو اسمها، ما أثار تكهنات واسعة حول هويته.
وبحسب التقارير، تجاوز حجم الاستخدام 50 تريليون رمز خلال خمسة أيام، ثم تخطى 60 تريليون رمز خلال ستة أيام وفق أرقام لاحقة. كما تصدر النموذج قوائم الاستخدام على المنصتين، ووصلت ذروة استعماله إلى أكثر من ضعف استخدام نماذج DeepSeek المماثلة، بحسب تقرير صيني. 3
قالت زيبو إن حركة الاستخدام خلال الاختبار شُغّلت بالكامل على عنقود يضم أكثر من 100 ألف شريحة صينية الصنع. وأضافت أن تحسين البرمجيات وكفاءة العتاد أوصلا كفاءة التشغيل وتكلفة كل رمز إلى مستويات قابلة للمقارنة مع وحدات معالجة الرسوميات الرئيسية من Nvidia. 3
6
لكن هذه النقطة تحتاج إلى قراءة دقيقة. فالمعلومات المتاحة لا تثبت أن الشرائح الصينية تضاهي عتاد Nvidia في جميع الاستخدامات، ولا أن تكلفة الاستدلال عليها تساوي تكلفة Nvidia بصورة عامة. ما تثبته التجربة هو أن حمولة استدلال عالمية وكبيرة يمكن تشغيلها عملياً على منظومة محلية غير معتمدة على Nvidia، عندما تقترن بتحسينات كبيرة في البرمجيات وتصميم النظام. 3
6
ولم تكشف زيبو أسماء موردي الشرائح. وذكرت تقارير أسماء Huawei وMoore Threads وHygon كموردين محتملين، لكن ذلك يظل تكهنات غير مؤكدة وليس إعلاناً رسمياً من الشركة. 40
تمثل هذه التجربة تحدياً جزئياً لميزة Nvidia المرتبطة بمنظومة CUDA، وهي بيئة البرمجيات والأدوات التي يعتمد عليها المطورون لتشغيل تطبيقات الذكاء الاصطناعي على معالجات الشركة.
فقد أظهرت زيبو أن مكدسات برمجية مصممة خصيصاً للنموذج، إلى جانب محركات استدلال محسّنة، يمكن أن تقلل الاعتماد على CUDA في بعض أحمال الاستدلال الإنتاجية. لكنها لا تلغي تفوق CUDA الأوسع في الأدوات، وقاعدة المطورين، والنظام البرمجي، ولا تثبت أن العتاد المحلي مناسب بالقدر نفسه للتدريب أو لكل أنواع النماذج.
وبحسب المواد التقنية المتاحة، اعتمد محرك الاستدلال المبني على SGLang على مجموعة من التقنيات، من بينها:
استهدفت هذه التغييرات تخفيف قيود الذاكرة وعرض النطاق الترددي والاتصالات وجدولة المهام، خصوصاً مع نافذة سياق تبلغ مليون رمز تقريباً. 4
7
وأفادت زيبو، بحسب التقارير، بأن هذه التحسينات رفعت أداء الخدمة من البداية إلى النهاية بنحو ثلاثة أضعاف مقارنة بخط الأساس الأولي. كما توثق مستندات SGLang لاحقاً تحسناً في معدل المعالجة وسعة أكبر بكثير لذاكرة FP8 مقارنة بإعداد BF16، لكن هذه البيانات ليست تدقيقاً مستقلاً لادعاء زيبو الأصلي بشأن التحسن ثلاثة أضعاف. 2
يضم GLM-5.3-Flash نحو 320 مليار مُعامل إجمالاً، مع تفعيل قرابة 18 مليار مُعامل لكل رمز. وتبلغ نافذة السياق 1,048,576 رمزاً، ما يسمح بالتعامل مع مدخلات طويلة جداً، كما أن النموذج متعدد الوسائط أصلاً ضمن سلسلة GLM-5. 5
7
وحصل النموذج، وفق التقارير، على 57 نقطة في مؤشر Artificial Analysis Intelligence Index، وهي النتيجة نفسها المعلنة لنموذج Claude Opus 4.8. لكن المقارنة تعني التكافؤ على مؤشر مركب محدد، ولا تعني تطابق الأداء في كل معيار أو مهمة واقعية، ولا سيما مهام الوكلاء البرمجيين المعقدة. 1
تسوق زيبو النموذج لمنافسة نماذج عالية الكفاءة من الفئة المتقدمة، مثل DeepSeek V4 Flash وDeepSeek V4 Pro، مع أسعار استدلال أقل بكثير. غير أن الأدلة المتاحة هنا لا تكفي للتحقق من مقارنة تفصيلية معياراً بمعيار مع كلا النموذجين.
حددت زيبو سعر واجهة برمجة التطبيقات عند:
ووصفت تقارير معاصرة السعر بأنه يعادل تقريباً عُشر سعر GLM-5.3 ونحو واحد من أربعين من سعر Claude Opus 4.8. لكن هذه النسب قد تختلف بحسب اتجاه الرموز، وطول السياق، ودرجة التسعير، والخطة المستخدمة في المقارنة. 1
لا تكمن أهمية كشف Ox Alpha في هوية النموذج وحدها. فزيبو جمعت بين نموذج كبير مفتوح الأوزان، وتسعير منخفض، واختبار عالمي واسع، ثم قالت إن كل ذلك أُنجز على بنية تحتية تعتمد على شرائح صينية. تشير النتيجة إلى أن هندسة الاستدلال وتحسين البرمجيات قد تكون عاملاً حاسماً في تقليص الفجوة بين العتاد المحلي ومنظومات Nvidia في بعض الاستخدامات، لكنها لا تمثل دليلاً على اختفاء هذه الفجوة في جميع المجالات.
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
أكدت زيبو للذكاء الاصطناعي في 26 أغسطس 2026 أن نموذج «Ox Alpha» أو «Niu Lai» المجهول هو GLM 5.3 Flash، وهو نموذج مفتوح الأوزان ومتعدد الوسائط أصلاً، مبني على بنية «خليط الخبراء».
أكدت زيبو للذكاء الاصطناعي في 26 أغسطس 2026 أن نموذج «Ox Alpha» أو «Niu Lai» المجهول هو GLM 5.3 Flash، وهو نموذج مفتوح الأوزان ومتعدد الوسائط أصلاً، مبني على بنية «خليط الخبراء». استقطب الاختبار المجاني المجهول على منصتي OpenRouter وOpenCode أكثر من 50 تريليون رمز خلال خمسة أيام، ثم تجاوزت التقارير 60 تريليون رمز خلال ستة أيام، مع تصدره قوائم الاستخدام على المنصتين.
قالت زيبو إن تشغيل الخدمة تم عبر عنقود يضم أكثر من 100 ألف شريحة صينية الصنع، من دون الكشف رسمياً عن الشركات الموردة لهذه الشرائح.