تستعد ByteDance، وفقاً لتقارير، لإطلاق نموذج ذكاء اصطناعي مبني على Seedance ينشئ فيديو مكانياً تفاعلياً لعوالم افتراضية، وقد يظهر في أقرب وقت خلال أكتوبر 2026. ترتبط الاستخدامات المعلنة في التقارير بالبث المباشر والدراما القصيرة والألعاب وسماعات Pico؛ أما ادعاءات 20 إطاراً في الثانية وزمن تأخير 0.05 ثانية فلم تُتحقق...
نشر بواسطةتم التحرير باستخدام GPT-5.6 Terraتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What is known about ByteDance’s reported real-time spatial video AI model—personally overseen by founder Zhang Yiming and potentially launch. Article summary: ByteDance is reportedly developing a Seedance-based real-time spatial-video, or “world model,” that could generate interactive 3D environments rather than conventional linear video. Zhang Yiming is said to be personally . Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
تعمل ByteDance، وفقاً لتقارير، على نظام ذكاء اصطناعي لتوليد الفيديو المكاني في الزمن الحقيقي؛ وهو نوع من «نماذج العوالم» يهدف إلى بناء بيئات رقمية يمكن للمستخدم التفاعل والتنقل داخلها، بدلاً من إنتاج مقاطع فيديو تقليدية تسير في اتجاه واحد. وأفادت بلومبرغ بأن المؤسس تشانغ يي مينغ يشرف بنفسه على المشروع، وأن الإطلاق قد يتم في أقرب وقت خلال الشهر المقبل، أي أكتوبر 2026، مع بقاء الجدول الزمني قابلاً للتغيير وعدم صدور تأكيد علني من ByteDance. 1
يُقال إن النموذج الجديد مبني على Seedance، تقنية ByteDance لتوليد الفيديو. وتصف الشركة Seedance 2.0 بأنه نموذج متعدد الوسائط للصوت والفيديو يستقبل النصوص والصور والصوت والفيديو كمدخلات.
لكن النموذج المكاني المُبلّغ عنه يتجاوز فكرة إنتاج مقطع ثابت: إذ يُفترض أن ينشئ عوالم افتراضية تفاعلية للبث المباشر والدراما القصيرة والألعاب. 7 والمقصود عملياً هو أن تستجيب البيئة لتحرك المستخدم أو تفاعله، لا أن تكون تسلسلاً مرئياً مُسبق التصيير يُشاهد من البداية إلى النهاية.
ولهذا يُطرح المشروع باعتباره «نموذج عالم». فبحسب Google DeepMind، تحاكي نماذج العوالم كيفية تغير البيئة وأثر الأفعال فيها؛ وقد صُمم نموذجها Genie 3 لتوليد بيئات تفاعلية من أوصاف نصية في الزمن الحقيقي.
بحسب تقرير بلومبرغ، ينسق تشانغ العمل بين وحدات أعمال ByteDance ويوجه موارد الذكاء الاصطناعي والقدرة الحاسوبية نحو النموذج. 1 ولا يعني ذلك وجود منتج مكتمل أو التزاماً نهائياً بموعد إطلاق؛ لكنه، إن صح، يشير إلى أن الشركة تنظر إلى المشروع بوصفه منصة تقنية أوسع، لا مجرد ميزة جديدة لتوليد الفيديو.
وقدمت بلومبرغ المبادرة في سياق منافسة مع Meta وAlphabet، مع تطبيقات محتملة تمتد من الترفيه إلى الروبوتات والأنظمة الذاتية. 1 وقد يكون المحتوى التفاعلي أقرب استخدام تجاري، فيما يتمثل الطموح التقني الأوسع في نموذج يحافظ على بيئة قابلة للاستخدام بينما تتبدل استجابةً لأفعال المستخدم.
ذكر تقرير، نقلاً عن أشخاص مطلعين، أن النموذج قد يولّد تدفقات فيديو بنحو 20 إطاراً في الثانية وبزمن تأخير يقارب 0.05 ثانية، وأنه قد يستجيب لصوت مستخدمي نظارات Pico أو حركتهم. 7
لكن ينبغي التعامل بحذر مع هذه الأرقام: فهي ادعاءات واردة في تقارير وليست نتائج اختبارات معيارية منشورة، ولم تصدر ByteDance وثائق تقنية تثبتها بصورة مستقلة. كذلك، لا يكفي معدل توليد واعد وحده لتجربة واقع ممتد (XR) جيدة؛ فاستقرار الصورة، واتساق المكان، وموثوقية الشبكة، وزمن التأخير بين حركة المستخدم وظهور النتيجة، وتكلفة الاستدلال، كلها عوامل حاسمة.
ومن الناحية النظرية، قد ينقل التصيير السحابي جزءاً من المعالجة بعيداً عن النظارة، ما قد يقلل متطلبات العتاد المحلي. لكن من المبكر الجزم بأن هذا النموذج سيخفض أسعار أجهزة Pico أو يمنحها أفضلية حاسمة على Meta أو Apple؛ فهذه احتمالات استراتيجية، وليست نتائج منتج مؤكدة.
تستند عبارة «في أقرب وقت خلال الشهر المقبل» إلى مصادر لم تُسمَّ. وقد قالت بلومبرغ إن المنتج يُجهَّز لإطلاق محتمل، لا إن له تاريخاً ثابتاً. 1 كما أشارت تقارير لاحقة أعادت نشر المعلومة إلى أن التوقيت قد يتغير.
8
إلى أن تعلن ByteDance رسمياً، من الأفضل الفصل بين ثلاثة مستويات من المعلومات:
لدى ByteDance موارد كبيرة يمكن توجيهها إلى البنية التحتية للذكاء الاصطناعي، لكنها ليست ميزانية مخصصة لهذا النموذج تحديداً. وذكرت رويترز أن الشركة حصلت على قرض بقيمة 29.6 مليار دولار من قرابة 30 بنكاً، وأن مصادر قالت إن العائدات ستدعم توسعها الخارجي في الذكاء الاصطناعي؛ كما ارتفع حجم التسهيل من هدف أولي قدره 20 مليار دولار.
وفي تقرير منفصل، ذكرت بلومبرغ أن ByteDance كانت تدرس إنفاقاً رأسمالياً قد يصل إلى 70 مليار دولار في 2026 على مراكز البيانات وغيرها من بنى الذكاء الاصطناعي. وهذا رقم تخطيطي مُبلّغ عنه، لا إنفاق مؤكد ولا تخصيص خاص بالنموذج المكاني.
وتقول تقارير استندت إلى تغطية 36Kr إن ByteDance وضعت هدف إصدار نموذج عالم واحد على الأقل بحلول نهاية 2026، وقياس أدائه مقابل Genie 3 من Google. إلا أن هذه أولويات داخلية مُبلّغ عنها، وليست تعهدات عامة من الشركة.
يمكن لنماذج الفيديو بالذكاء الاصطناعي إنتاج لقطات مقنعة، لكن البيئة التفاعلية تتطلب قدرات أصعب: الحفاظ على مشهد متماسك مع مرور الوقت، وجعل هذا المشهد يستجيب بصورة منطقية للمدخلات. وهذه هي جاذبية نماذج العوالم وتحديها التقني الأساسي.
إذا نجحت ByteDance في ذلك، فقد تصل بين تقنيات توليد الفيديو لديها والترفيه التفاعلي والواقع الممتد. أما على مستوى القطاع، فستضيف منافساً كبيراً إلى مجال تتصدره علناً شركات مثل Google وMeta. لكن الاستنتاج المدعوم بالأدلة يظل محدداً: يبدو أن ByteDance تطور بجدية نموذج عالم للفيديو المكاني مبنياً على Seedance، ويحظى باهتمام تشانغ يي مينغ وفقاً للتقارير. أما الجودة الفعلية وموعد الإطلاق والأثر على Pico، فكلها أمور غير مثبتة إلى أن تكشف الشركة عن المنتج ونتائجه التقنية القابلة للقياس. 1
7
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
تستعد ByteDance، وفقاً لتقارير، لإطلاق نموذج ذكاء اصطناعي مبني على Seedance ينشئ فيديو مكانياً تفاعلياً لعوالم افتراضية، وقد يظهر في أقرب وقت خلال أكتوبر 2026.
تستعد ByteDance، وفقاً لتقارير، لإطلاق نموذج ذكاء اصطناعي مبني على Seedance ينشئ فيديو مكانياً تفاعلياً لعوالم افتراضية، وقد يظهر في أقرب وقت خلال أكتوبر 2026. ترتبط الاستخدامات المعلنة في التقارير بالبث المباشر والدراما القصيرة والألعاب وسماعات Pico؛ أما ادعاءات 20 إطاراً في الثانية وزمن تأخير 0.05 ثانية فلم تُتحقق منها اختبارات مستقلة منشورة.
يضع المشروع ByteDance في سباق «نماذج العوالم»، وهي أنظمة تستهدف محاكاة بيئات تتفاعل مع المستخدم بدلاً من إنتاج مقاطع فيديو خطية فقط.