قدّمت لي أوتو في ٢٢ سبتمبر ٢٠٢٦ نظام ME Brain 1.0، ونموذج الرؤية واللغة ME VLM، ونموذج الفهم وتوليد الأفعال ME U0. بلغ متوسط النجاح المعلن لـME U0 نسبة 99.1% على LIBERO و81.8% على LIBERO Plus بعد تكييفه باستخدام بيانات إشراف خاصة بكل اختبار؛ ولا تمثل النسبتان نجاحًا بلا تدريب مسبق في بيئات واقعية غير مألوفة.
نشر بواسطةتم التحرير باستخدام GPT-6 Solتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What did Li Auto’s Foundation Model team release in its September 22, 2026, MachEmbodied embodied-AI trilogy, and how do ME-Brain-1.0, ME-VL. Article summary: Li Auto’s Foundation Model team presented three complementary pieces on September 22: ME-Brain-1.0 as an embodied-agent system, ME-VLM as its vision-language cognitive core, and ME-U0 as a model for understanding scenes . Topic tags: general, academic, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
إذا رأى الروبوت غرضًا أمامه، فكيف يفسّر المشهد، ويقرر ما المطلوب، ثم يحوّل قراره إلى حركة؟ تحاول إصدارات فريق النماذج الأساسية في شركة السيارات الصينية لي أوتو الإجابة عن أجزاء مختلفة من هذا السؤال. ففي ٢٢ سبتمبر ٢٠٢٦، قدّم الفريق نظام ME-Brain-1.0، ونموذج الرؤية واللغة MachEmbodied-VLM (ME-VLM)، ونموذج الفهم وتوليد الأفعال MachEmbodied-U0 (ME-U0). وهي إصدارات متكاملة في تصورها، لكنها ليست دليلًا بحد ذاتها على تشغيلها معًا ضمن روبوت مستقل جرى التحقق منه خارجيًا. 3
5
ME-Brain-1.0 هو تصور المنظومة ككل. تصفه لي أوتو من خلال الذاكرة والإدراك والفعل. وتشير التغطية إلى إمكان تشغيل وحدات مرتبطة بالذاكرة على شريحة M100 من نوع «نظام على شريحة» (SoC)، لتوليد المعلومات المخزنة واسترجاعها محليًا. هذا ادعاء يخص تلك الوحدات، لا تشغيل جميع مكونات ME-Brain على الشريحة نفسها. 3
5
ME-VLM معنيّ بفهم المعلومات المرئية واللغوية وتنسيق قرارات الوكيل الذكي. يصف تقريره الفني تدريبًا يشمل مهام روبوتية ومتعددة الوسائط، مع ملاحظات عن التنفيذ وتغذية راجعة تساعد على تقييم النتائج وتحسين القرارات. وتذكر التغطية نسخة كبيرة ببنية «مزيج الخبراء» 35B-A3B، وأخرى أصغر بحجم 4B مخصصة للتشغيل على الجهاز. 1
5
ME-U0 يصل الفهم بتوليد الفعل. فتصميمه الموصوف باسم «مزيج المحوّلات» يربط مكونات متخصصة في تفسير المهمة والمشهد بمكونات متخصصة في توليد الأفعال. والفرق جوهري: معرفة ما ينبغي فعله لا تعني تلقائيًا القدرة على تنفيذه بحركة روبوتية ناجحة. ولا تثبت الإصدارات المنشورة أن النماذج الثلاثة اختُبرت معًا في نشر مستقل واحد. 2
5
وفق جداول المقارنة المنقولة عن الشركة، حققت النسخة الكبيرة من ME-VLM متوسطًا يقارب 70.9 في مجموعات اختبارات الذكاء المتجسّد و72.5 في اختبارات الوكلاء، وجاءت نسخة 4B ثانيةً في مقارنات الشركة. تصف هذه الأرقام تقييمات محددة، ولا تكفي، من دون تفاصيل ظروف الاختبار وإعادة مستقلة له، للحكم على موثوقية الروبوتات عمومًا. 5
وتعلن لي أوتو حصول ME-U0 على 17.66 نقطة في RoboDojo، ومتوسط نجاح يبلغ 99.1% في LIBERO و81.8% في LIBERO-Plus. لكن نتيجتَي LIBERO جاءتا بعد تكييف النموذج بإشراف توفره كل مجموعة اختبار؛ فلا يصح تقديمهما بوصفهما أداءً من دون تكييف مسبق في مهام مادية جديدة. 3
تقول الشركة إنها انتقت نحو 4,200 ساعة لتدريب ME-U0 المبدئي من مجموعات أولية تضم قرابة 5,700 ساعة من بيانات الروبوتات و3,920 ساعة من الفيديو المصوّر من منظور الشخص الأول. قد يوسّع الجمع بين النوعين تنوّع المشاهد التي يتعرض لها النموذج، لكن عدد الساعات وحده لا يبيّن قدرته على التعامل مع روبوت أو بيئة جديدين. 3
أما في التشغيل على الجهاز، فيفيد مؤلفو تقرير ME-VLM بأن ضغط الرموز البصرية، والتكميم W4A8، وتحسين البرمجيات والعتاد معًا، أتاحت تشغيل نسخة 4B على شريحة M100 وخفّضت زمن مرحلة معالجة المدخلات الأولية من 400 إلى 188 مللي ثانية. هذه مرحلة واحدة من تشغيل النموذج، وليست المدة الكاملة بين رصد الروبوت تغيّرًا وتنفيذ استجابة حركية. ولا تثبت المواد المشار إليها تشغيل نسخة 35B-A3B أو منظومة ME-Brain وME-U0 كاملةً معًا على شريحة M100 واحدة. 1
5
تصف تغطية الإطلاق عرضًا للإمساك بالأشياء استمر ساعة، وتسلسلًا لإعداد القهوة ضم 15 خطوة في نحو أربع دقائق. يوضح العرضان طبيعة المهام التي اختارت لي أوتو إظهارها، لكنهما لا يحددان معدلات النجاح عند اختيار الأشياء أو الإضاءة بصورة مستقلة، أو عند حدوث انقطاعات وأخطاء خلال استخدام طويل. كما أن المواد المشار إليها لا تسند استنتاجًا محددًا من طرف ثالث بشأن إخفاقات في هذين العرضين. 3
الاختبار الحاسم التالي هو تقييم مستقل، محدد الشروط وقابل للتكرار، للمنظومة المتكاملة: قياس نجاح المهام والتعافي من الإخفاق في إعدادات غير مألوفة، مع قياس الزمن الكامل من الإدراك إلى الفعل على العتاد المعلن. وحتى يحدث ذلك، تبقى درجات الاختبارات وتحسّن زمن المعالجة على M100 أدلة منفصلة وواعدة، لا حكمًا نهائيًا على جاهزية روبوت عام الاستخدام. 1
3
5
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
قدّمت لي أوتو في ٢٢ سبتمبر ٢٠٢٦ نظام ME Brain 1.0، ونموذج الرؤية واللغة ME VLM، ونموذج الفهم وتوليد الأفعال ME U0.
قدّمت لي أوتو في ٢٢ سبتمبر ٢٠٢٦ نظام ME Brain 1.0، ونموذج الرؤية واللغة ME VLM، ونموذج الفهم وتوليد الأفعال ME U0. بلغ متوسط النجاح المعلن لـME U0 نسبة 99.1% على LIBERO و81.8% على LIBERO Plus بعد تكييفه باستخدام بيانات إشراف خاصة بكل اختبار؛ ولا تمثل النسبتان نجاحًا بلا تدريب مسبق في بيئات واقعية غير مألوفة.
انخفض زمن مرحلة معالجة المدخلات الأولية في نسخة ME VLM الأصغر على شريحة M100 من 400 إلى 188 مللي ثانية، لكن ذلك ليس قياسًا لزمن استجابة الروبوت من الرؤية إلى الحركة.