بعيداً عن السرعة، يعالج Grok Imagine Video 1.5 التشوهات البصرية التي طالما عانت منها نماذج الفيديو الذكية. النسخة السابقة كانت غالباً ما تعاني من ترابط الحركة، منتجةً مقاطع تظهر فيها التواءات غير طبيعية للأطراف وأجساماً "عائمة" تفضح أصلها الاصطناعي . يصحح نموذج 1.5 الكثير من هذا السلوك، مقدمًا حركة شخصيات وكاميرا أكثر سلاسة وطبيعية بشكل ملحوظ
.
بشكل أكثر دقة، يحاكي النموذج الآن الفيزياء الواقعية بفروقات دقيقة أكبر، مظهراً فهماً محسّناً للوزن والزخم. يمكن للمشاهد أن تصوّر شخصاً يمشي مع تأرجح طبيعي لملابسه، أو جسماً يسقط متبعاً منحنى تسارع واقعياً، مما ينتج مقاطع فيديو تبدو قائمة على أسس فيزيائية بدلاً من كونها مركبة رقمياً .
الإضافة الأكثر أهمية من الناحية الاستراتيجية هي تقديم ميزة إنتاج الصوت المتزامن المدمج، وهي ميزة كانت غائبة تماماً عن الإصدار السابق . في الماضي، كانت إضافة الصوت إلى مقطع تم إنتاجه عبر Grok تتطلب أدوات خارجية ومزامنة يدوية. أما الإصدار 1.5 فينتج الفيديو الآن بصوت مرتبط تلقائياً بالحدث على الشاشة – حيث يتم توليد الأصوات المحيطة، المؤثرات الصوتية، والجو العام إلى جانب المرئيات
. هذا يزيل نقطة احتكاك رئيسية في خط الإنتاج الإبداعي، مما يسمح للفنانين وصناع المحتوى بإنتاج مقطع سمعي بصري كامل في خطوة واحدة
.
يأتي الإطلاق بعد مرحلة معاينة ناجحة جداً بدأت في 3 يونيو 2026 . خلال هذه الفترة، فرض Grok Imagine Video 1.5 هيمنته بسرعة على المعايير الصناعية، صاعداً إلى المركز الأول في منصة Artificial Analysis Video Arena بقفزة هائلة قدرها +52 نقطة Elo مقارنة بنموذج 1.0 الأقدم
. لقد تفوق على منافسين ثقيلين من بينهم Seedance 2.0 من ByteDance و Veo من Google، وهو إنجاز روّج له الرئيس التنفيذي إيلون ماسك عبر مشاركة مقطع تشويقي تم توليده بالذكاء الاصطناعي لفيلم الإلياذة حصد أكثر من 18 مليون مشاهدة على منصة X
.
Grok Imagine Video 1.5 هو نموذج منفصل عن روبوت المحادثة Grok، رغم اشتراكهما في العلامة التجارية. إنه نموذج مخصص لتحويل النصوص والصور إلى فيديو . مع انتهاء فترة المعاينة الآن، أصبح متاحاً للمطورين عبر منصة xAI API تحت اسم النموذج
grok-imagine-video-1.5 وللمستخدمين العاديين عبر تطبيق Grok Imagine على الويب و iOS و Android . من خلال طي الصوت المتزامن مباشرةً في خط أنابيب التوليد السريع الخاص بها، تراهن xAI على تجربة إبداعية شاملة ومتكاملة لتحديد المرحلة التالية من المشهد التنافسي لتوليد الفيديو بالذكاء الاصطناعي
.