FlashX مستوى أسرع لتقديم GLM 5.3 Flash عبر واجهة برمجية، وليس إصداراً منفصلاً موثقاً بأوزان مفتوحة أو بنية جديدة. تعلن الشركة سرعة تصل إلى 200 رمز مخرَج في الثانية؛ وهو حد أقصى معلن، لا نتيجة مقارنة مستقلة مع النموذج الأساسي في ظروف متماثلة.
نشر بواسطةتم التحرير باستخدام GPT-6 Solتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What is Zhipu AI’s GLM 5.3 FlashX, how does it differ from the open sourced GLM 5.3 Flash base model, and what does Zhipu claim about its sp. Article summary: GLM 5.3 FlashX is Zhipu AI’s faster, API served version of its open sourced GLM 5.3 Flash model.. Topic tags: general web, openai, llm, agents, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factua
إذا كنت تختار نموذجاً لتطبيقك، فالتمييز المهم هنا هو بين سرعة استجابة مستخدم واحد وقدرة الخدمة على معالجة طلبات كثيرة. تطلق «تشيبو إيه آي» اسم GLM-5.3-FlashX على نسخة أسرع تُتاح عبر واجهة برمجية من GLM-5.3-Flash مفتوح الأوزان. وتعرض الشركة الفارق بوصفه تحسيناً في الاستدلال وتقديم الخدمة، لا بنية نموذج جديدة موثقة أو إصداراً منفصلاً بأوزان مفتوحة. 1
4
النموذج الأساسي Flash متعدد الوسائط، ويستخدم بنية «مزيج الخبراء»: يضم 320 مليار معلمة إجمالاً، تُفعّل منها 18 ملياراً أثناء المعالجة، مع نافذة سياق معلنة تصل إلى مليون رمز. أما الرقم الذي تبرز به الشركة FlashX فهو سرعة تصل إلى 200 رمز مخرَج في الثانية. هذه سرعة قصوى تعلنها الجهة المطوّرة، وليست دليلاً بحد ذاتها على مقدار تفوق FlashX على Flash عند اختبارهـما تحت الحمل والظروف نفسيهما. 1
7
4
تقول تشيبو إن حركة الاستخدام الإنتاجية لنموذج Flash تعمل على أكثر من 100 ألف مسرّع ذكاء اصطناعي صيني الصنع. ووفق روايتها، ساعد وكيل برمجي للبنية التحتية يُسمّى Infra Agent، ويعمل بنموذج GLM-5.3، في تشخيص اختناقات الأداء وتعديل الشيفرة وتحسين نظام تقديم الاستدلال؛ وشملت الأعمال المبلّغ عنها تخفيف اختناق التزامن عند نقل بيانات KV وتحسين مكوّن لفك الترميز. وتقول إن إنتاجية الخدمة من البداية إلى النهاية بلغت 3.2 أمثال مستواها الابتدائي خلال أقل من أسبوعين. هذا مقياس لقدرة النظام ككل، وليس معدل توليد الرموز الذي سيحصل عليه كل مستخدم في FlashX. 5
6
13
وتقول الشركة أيضاً إن استغلال العتاد وتكلفة تقديم الخدمة لكل رمز أصبحا بمستوى مقارب لأنظمة تعتمد على وحدات معالجة الرسوميات الشائعة من «إنفيديا». لكن انخفاض تكلفة التشغيل المزعوم لا يعني انخفاض السعر على العميل: الأسعار المدرجة لكل مليون رمز هي 0.37 دولار للمدخلات و1.25 دولار للمخرجات في FlashX، مقابل 0.15 و0.50 دولار على الترتيب في Flash؛ أي إن سعر رموز المخرجات في FlashX أعلى بنحو 2.5 مرة. 7
13
4
5
ما زالت هناك حاجة إلى قياسات مستقلة لثبات سرعة 200 رمز في الثانية وزمن الاستجابة والموثوقية عند تزامن الطلبات، ولعدد المسرّعات ونطاق حركة الإنتاج التي تخدمها. كما يلزم فحص خط الأساس وراء زيادة الإنتاجية المعلنة، وفصل مساهمة Infra Agent عن عمل المهندسين، وإجراء مقارنة متكافئة لتكلفة الرمز مع أنظمة إنفيديا. التقارير المتاحة تنقل هذه الأرقام في معظمها عن تشيبو، ولا تمثل تدقيقاً مستقلاً لها. 1
5
6
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
FlashX مستوى أسرع لتقديم GLM 5.3 Flash عبر واجهة برمجية، وليس إصداراً منفصلاً موثقاً بأوزان مفتوحة أو بنية جديدة.
FlashX مستوى أسرع لتقديم GLM 5.3 Flash عبر واجهة برمجية، وليس إصداراً منفصلاً موثقاً بأوزان مفتوحة أو بنية جديدة. تعلن الشركة سرعة تصل إلى 200 رمز مخرَج في الثانية؛ وهو حد أقصى معلن، لا نتيجة مقارنة مستقلة مع النموذج الأساسي في ظروف متماثلة.
تقول تشيبو إن تحسينات خدمة Flash على أكثر من 100 ألف مسرّع صيني رفعت إنتاجية النظام إلى 3.2 أمثال خط البداية، لكن هذه المزاعم تحتاج إلى تحقق مستقل.