ByteDance dilaporkan sedang menyiapkan model AI berasaskan Seedance yang menjana video ruang interaktif untuk dunia maya, dengan pelancaran berpotensi seawal Oktober 2026. Laporan mengaitkan model itu dengan siaran langsung, drama pendek, permainan dan set kepala Pico.
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is known about ByteDance’s reported real-time spatial video AI model—personally overseen by founder Zhang Yiming and potentially launch. Article summary: ByteDance is reportedly developing a Seedance-based real-time spatial-video, or “world model,” that could generate interactive 3D environments rather than conventional linear video. Zhang Yiming is said to be personally . Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
ByteDance dilaporkan sedang membangunkan sistem AI bagi penjanaan video ruang masa nyata — sejenis model dunia yang bertujuan menghasilkan persekitaran digital yang boleh diteroka dan diberi respons, bukannya klip video linear biasa. Bloomberg melaporkan pengasasnya, Zhang Yiming, memantau sendiri pembangunan itu dan produk berkenaan mungkin dilancarkan seawal bulan depan, iaitu Oktober 2026. Namun, jadual tersebut masih boleh berubah dan ByteDance belum mengesahkan projek itu secara terbuka. 1
Model baharu itu dikatakan dibina berasaskan Seedance, teknologi penjanaan video ByteDance. Seedance 2.0 ialah model audio-video multimodal yang menerima teks, imej, audio dan video sebagai input, menurut bahan pelancaran ByteDance sendiri.
Bezanya, sistem video ruang yang dilaporkan itu tidak sekadar menghasilkan video siap untuk ditonton. Ia dikatakan boleh membina dunia maya interaktif bagi kegunaan seperti siaran langsung, drama pendek dan permainan. 7 Secara mudah, pengguna sepatutnya boleh bergerak atau berinteraksi dalam sesuatu babak, lalu persekitaran itu berubah balas — bukan hanya menonton rakaman yang bergerak dari awal hingga akhir.
Inilah sebabnya projek tersebut dibincangkan sebagai model dunia. Google DeepMind menerangkan model dunia sebagai sistem yang mensimulasikan perubahan dalam persekitaran dan kesan tindakan terhadapnya. Genie 3 milik DeepMind, misalnya, direka untuk menjana persekitaran interaktif daripada arahan teks dalam masa nyata.
Menurut laporan Bloomberg, Zhang menyelaras kerja merentas unit perniagaan ByteDance serta mengarahkan sumber AI dan kapasiti pengkomputeran kepada model itu. 1 Ini bukan bukti bahawa produk sudah siap atau pasti dilancarkan. Namun, jika laporan itu tepat, penglibatan peringkat pengasas menunjukkan ByteDance melihatnya sebagai usaha platform yang lebih besar daripada sekadar ciri baharu untuk penjanaan video AI.
Bloomberg membingkaikan inisiatif itu sebagai persaingan dengan Meta dan Alphabet, dengan potensi kegunaan melangkaui hiburan termasuk robotik serta sistem autonomi. 1 Media interaktif mungkin menjadi aplikasi komersial paling hampir, manakala cita-cita teknikal lebih luasnya ialah membina model yang mampu mengekalkan persekitaran yang boleh digunakan apabila tindakan pengguna mengubahnya.
Satu laporan yang memetik individu yang mengetahui projek itu mendakwa model berkenaan boleh menjana strim video sekitar 20 bingkai sesaat (fps) dengan kependaman kira-kira 0.05 saat. Sistem itu juga dikatakan boleh memberi respons kepada suara atau pergerakan pengguna set kepala Pico. 7
Angka ini perlu dilihat dengan berhati-hati. Ia ialah dakwaan yang dilaporkan, bukannya keputusan penanda aras awam yang telah disahkan secara bebas, dan ByteDance belum menerbitkan dokumentasi teknikal untuk mengesahkannya. Produk realiti lanjutan (XR) masa nyata juga memerlukan lebih daripada kadar penjanaan yang pantas: kestabilan imej, konsistensi ruang, kebolehpercayaan rangkaian, kependaman antara pergerakan dan paparan, serta kos inferens semuanya akan menentukan pengalaman sebenar.
Secara teori, pemaparan awan boleh memindahkan sebahagian kerja pengkomputeran daripada set kepala, sekali gus mungkin mengurangkan keperluan perkakasan pada peranti. Tetapi masih terlalu awal untuk menyimpulkan bahawa model ini akan menurunkan harga Pico atau memberi kelebihan muktamad terhadap Meta dan Apple. Itu ialah kemungkinan strategik, bukannya hasil produk yang telah disahkan.
Frasa “seawal bulan depan” bersandarkan sumber tanpa nama. Bloomberg secara khusus melaporkan bahawa produk itu sedang disediakan untuk kemungkinan pelancaran, bukannya mengumumkan tarikh tetap. 1 Laporan susulan yang mengulangi dakwaan tersebut juga menyatakan jadualnya boleh berubah.
8
Sehingga ByteDance mengeluarkan pengumuman rasmi, pembangun dan bakal pengguna wajar membezakan tiga perkara berikut:
ByteDance mempunyai sumber besar untuk infrastruktur AI, walaupun ia bukan belanjawan khusus bagi model ini. Reuters melaporkan syarikat itu memperoleh pinjaman AS$29.6 bilion daripada hampir 30 bank, dengan sumber berkata hasil pinjaman itu akan menyokong peluasan AI di luar negara. Kemudahan pinjaman tersebut dilaporkan meningkat daripada sasaran awal AS$20 bilion.
Secara berasingan, Bloomberg melaporkan ByteDance mempertimbangkan perbelanjaan modal sehingga AS$70 bilion pada 2026 bagi pusat data dan infrastruktur AI lain. Itu ialah angka perancangan yang dilaporkan, bukan perbelanjaan yang disahkan dan bukan peruntukan khusus untuk satu model.
Laporan yang bersandarkan liputan 36Kr turut menyatakan ByteDance menetapkan sasaran untuk mengeluarkan sekurang-kurangnya satu model dunia menjelang akhir 2026 dan menjadikan Genie 3 Google sebagai penanda aras. Ini ialah keutamaan dalaman yang dilaporkan, bukannya komitmen awam ByteDance.
Model video AI boleh menghasilkan klip yang meyakinkan, tetapi persekitaran interaktif memerlukan keupayaan yang lebih sukar: sistem perlu mengekalkan babak yang konsisten dari semasa ke semasa dan menjadikannya bertindak balas secara munasabah terhadap input pengguna. Itulah tarikan utama — dan cabaran teknikal besar — bagi model dunia.
Bagi ByteDance, sistem yang berjaya boleh menghubungkan kerja penjanaan videonya dengan hiburan interaktif dan realiti lanjutan. Bagi industri pula, ia menambah seorang lagi pesaing besar dalam bidang yang kini diterajui secara terbuka oleh syarikat seperti Google dan Meta. Namun, kesimpulan yang paling munasabah buat masa ini adalah terhad: ByteDance nampaknya sedang mengejar usaha serius untuk membangunkan model dunia video ruang berasaskan Seedance, dengan perhatian langsung Zhang Yiming. Kualiti dunia sebenar, jadual pelancaran dan kesan terhadap Pico masih belum terbukti sehingga ByteDance melancarkan produk serta menerbitkan hasil teknikal yang boleh diukur. 1
7
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
ByteDance dilaporkan sedang menyiapkan model AI berasaskan Seedance yang menjana video ruang interaktif untuk dunia maya, dengan pelancaran berpotensi seawal Oktober 2026.
ByteDance dilaporkan sedang menyiapkan model AI berasaskan Seedance yang menjana video ruang interaktif untuk dunia maya, dengan pelancaran berpotensi seawal Oktober 2026. Laporan mengaitkan model itu dengan siaran langsung, drama pendek, permainan dan set kepala Pico.
Usaha ini meletakkan ByteDance dalam persaingan “model dunia” — sistem yang cuba mensimulasikan persekitaran interaktif, bukan sekadar menghasilkan klip video sehala.