ByteDance มีรายงานว่ากำลังเตรียมโมเดล AI ที่ต่อยอดจาก Seedance เพื่อสร้างวิดีโอเชิงพื้นที่และโลกเสมือนที่โต้ตอบได้ โดยอาจเปิดตัวเร็วที่สุดในเดือนตุลาคม 2026 รายงานเชื่อมโมเดลนี้กับไลฟ์สด ซีรีส์สั้น เกม และอาจรวมถึงเฮดเซ็ต Pico ส่วนตัวเลข 20 เฟรมต่อวินาทีและความหน่วงราว 0.05 วินาทียังเป็นข้อมูลที่รายงานอ้าง ไม่ใช่ผลท...
เผยแพร่โดยแก้ไขด้วย GPT-5.6 Terraรูปภาพสร้างด้วย GPT Image 2
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What is known about ByteDance’s reported real-time spatial video AI model—personally overseen by founder Zhang Yiming and potentially launch. Article summary: ByteDance is reportedly developing a Seedance-based real-time spatial-video, or “world model,” that could generate interactive 3D environments rather than conventional linear video. Zhang Yiming is said to be personally . Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
ByteDance มีรายงานว่ากำลังพัฒนาระบบ AI สำหรับสร้าง วิดีโอเชิงพื้นที่แบบเรียลไทม์ ซึ่งเป็นเทคโนโลยีประเภท “เวิลด์โมเดล” (world model) ที่มุ่งสร้างสภาพแวดล้อมดิจิทัลให้ผู้ใช้โต้ตอบและเคลื่อนสำรวจได้ แทนการสร้างคลิปวิดีโอแบบเส้นตรงที่เล่นจบไปตามลำดับ Bloomberg รายงานว่า จาง อี้หมิง ผู้ก่อตั้งบริษัท กำกับงานนี้ด้วยตัวเอง และผลิตภัณฑ์อาจเปิดตัวได้เร็วที่สุดในเดือนหน้า แต่ตารางเวลาดังกล่าวยังเปลี่ยนแปลงได้ และ ByteDance ยังไม่ได้ยืนยันโครงการต่อสาธารณะ 1
รายงานระบุว่าโมเดลใหม่นี้สร้างบนฐานของ Seedance เทคโนโลยีสร้างวิดีโอของ ByteDance โดย Seedance 2.0 เป็นโมเดลเสียง-วิดีโอแบบมัลติโหมดที่รับข้อมูลได้ทั้งข้อความ ภาพ เสียง และวิดีโอ ตามเอกสารเปิดตัวของ ByteDance
หัวใจสำคัญคือระบบที่รายงานว่าจะไม่เพียงผลิตวิดีโอหนึ่งคลิป แต่สามารถสร้างโลกเสมือนแบบโต้ตอบได้สำหรับไลฟ์สด ซีรีส์สั้น และเกม 7 กล่าวอย่างเข้าใจง่าย เป้าหมายคือฉากดิจิทัลที่เปลี่ยนแปลงตามการเคลื่อนไหวหรือการกระทำของผู้ใช้ ไม่ใช่ภาพที่เรนเดอร์เสร็จล่วงหน้าแล้วเล่นจากต้นจนจบ
นี่คือเหตุผลที่โครงการถูกจัดอยู่ในกลุ่มเวิลด์โมเดล Google DeepMind อธิบายว่า เวิลด์โมเดลคือระบบที่จำลองการเปลี่ยนแปลงของสภาพแวดล้อม และผลของการกระทำต่อสภาพแวดล้อมนั้น ตัวอย่างอย่าง Genie 3 ถูกออกแบบมาให้สร้างสภาพแวดล้อมแบบโต้ตอบจากข้อความได้แบบเรียลไทม์
Bloomberg รายงานว่า จางกำลังประสานงานข้ามหน่วยธุรกิจของ ByteDance และจัดสรรทรัพยากร AI กับกำลังประมวลผลไปยังโมเดลนี้ 1 ข้อมูลนี้ไม่ได้หมายความว่าผลิตภัณฑ์เสร็จสมบูรณ์แล้ว หรือเป็นคำยืนยันว่าจะเปิดตัวแน่นอน แต่หากรายงานถูกต้อง การมีผู้ก่อตั้งเข้ามาดูแลโดยตรงสะท้อนว่า ByteDance อาจมองโครงการนี้เป็นเทคโนโลยีระดับแพลตฟอร์ม ไม่ใช่เพียงฟีเจอร์เพิ่มในเครื่องมือสร้างวิดีโอ AI
Bloomberg วางโครงการนี้ไว้ในบริบทการแข่งขันกับ Meta และ Alphabet โดยมองว่าการประยุกต์ใช้อาจไปไกลกว่าสื่อบันเทิง สู่หุ่นยนต์และระบบอัตโนมัติ 1 สื่อเชิงโต้ตอบอาจเป็นกรณีใช้งานเชิงพาณิชย์ที่เข้าถึงได้ก่อน ขณะที่เป้าหมายด้านเทคนิคที่ใหญ่กว่าคือการทำให้โมเดลรักษาสภาพแวดล้อมที่ใช้งานได้ แม้โลกนั้นเปลี่ยนไปตามการกระทำ
รายงานหนึ่งซึ่งอ้างแหล่งข่าวที่รู้เรื่องโครงการ ระบุว่าโมเดลอาจสร้างสตรีมวิดีโอได้ราว 20 เฟรมต่อวินาที ที่ความหน่วงประมาณ 0.05 วินาที และอาจตอบสนองต่อคำสั่งเสียงหรือการเคลื่อนไหวของผู้ใช้เฮดเซ็ต Pico ได้ 7
อย่างไรก็ดี ตัวเลขเหล่านี้ควรถูกมองอย่างระมัดระวัง เพราะเป็นข้อมูลจากรายงาน ไม่ใช่ผลทดสอบมาตรฐานที่เปิดเผยต่อสาธารณะ และ ByteDance ยังไม่ได้เผยแพร่เอกสารเทคนิคที่ใช้ตรวจสอบได้อย่างอิสระ นอกจากนี้ ประสบการณ์ XR ที่ใช้งานจริงยังขึ้นกับมากกว่าอัตราการสร้างภาพ เช่น ความนิ่งของภาพ ความสอดคล้องของพื้นที่ ความเสถียรของเครือข่าย ความหน่วงตั้งแต่การเคลื่อนไหวจนถึงภาพที่แสดง และต้นทุนการประมวลผล
การเรนเดอร์ผ่านคลาวด์อาจช่วยย้ายภาระการประมวลผลออกจากเฮดเซ็ต จึงมีความเป็นไปได้ในทางทฤษฎีว่าจะลดความต้องการฮาร์ดแวร์ในตัวอุปกรณ์ได้ แต่ยังเร็วเกินไปที่จะสรุปว่าโมเดลนี้จะทำให้ Pico ราคาถูกลง หรือสร้างความได้เปรียบชัดเจนเหนือ Meta หรือ Apple สิ่งเหล่านี้เป็นนัยเชิงกลยุทธ์ที่เป็นไปได้ ไม่ใช่ผลลัพธ์ผลิตภัณฑ์ที่ยืนยันแล้ว
กรอบเวลาที่ว่า “เร็วที่สุดในเดือนหน้า” มาจากแหล่งข่าวนิรนาม Bloomberg ระบุเพียงว่าผลิตภัณฑ์กำลังถูกเตรียมไว้เพื่อการเปิดตัวที่เป็นไปได้ ไม่ได้ประกาศวันเปิดตัวตายตัว 1 รายงานอื่นที่กล่าวถึงประเด็นเดียวกันก็ย้ำว่ากำหนดเวลาอาจเปลี่ยนได้
8
จนกว่า ByteDance จะประกาศอย่างเป็นทางการ ผู้พัฒนาและผู้ที่กำลังพิจารณาอุปกรณ์ควรแยกประเด็นต่อไปนี้ออกจากกันให้ชัด:
ByteDance มีทรัพยากรจำนวนมากสำหรับโครงสร้างพื้นฐาน AI แม้จะไม่ใช่งบเฉพาะของโมเดลนี้ Reuters รายงานว่าบริษัทได้รับเงินกู้ 29.6 พันล้านดอลลาร์สหรัฐ จากธนาคารเกือบ 30 แห่ง โดยแหล่งข่าวระบุว่าจะนำไปสนับสนุนการขยายธุรกิจ AI ในต่างประเทศ และวงเงินเพิ่มขึ้นจากเป้าหมายเดิม 20 พันล้านดอลลาร์
แยกกันนั้น Bloomberg รายงานว่า ByteDance กำลังพิจารณารายจ่ายลงทุนสูงสุดถึง 70 พันล้านดอลลาร์สหรัฐ ในปี 2026 เพื่อสร้างดาต้าเซ็นเตอร์และโครงสร้างพื้นฐาน AI อื่น ๆ ตัวเลขดังกล่าวเป็นแผนที่มีรายงาน ไม่ใช่ยอดใช้จ่ายที่ยืนยันแล้ว และไม่ได้จัดสรรเฉพาะให้กับโมเดลนี้
รายงานที่อ้างอิงการรายงานของ 36Kr ยังระบุว่า ByteDance ตั้งเป้าจะปล่อยเวิลด์โมเดลอย่างน้อยหนึ่งรุ่นภายในสิ้นปี 2026 และใช้ Genie 3 ของ Google เป็นเกณฑ์เปรียบเทียบ ทั้งหมดนี้เป็นลำดับความสำคัญภายในที่มีรายงาน ไม่ใช่คำมั่นสาธารณะของ ByteDance
โมเดลวิดีโอ AI สามารถสร้างคลิปที่ดูน่าเชื่อได้ แต่สภาพแวดล้อมแบบโต้ตอบต้องผ่านโจทย์ที่ยากกว่า ระบบต้องคงฉากให้ต่อเนื่องเป็นเหตุเป็นผลเมื่อเวลาผ่านไป และตอบสนองต่อข้อมูลจากผู้ใช้ได้อย่างสมจริง นั่นคือทั้งเสน่ห์และความท้าทายทางเทคนิคของเวิลด์โมเดล
หากทำได้สำเร็จ ByteDance อาจเชื่อมงานวิดีโอ AI เข้ากับความบันเทิงเชิงโต้ตอบและเทคโนโลยีความจริงขยาย (XR) ได้ สำหรับอุตสาหกรรมโดยรวม โครงการนี้จะเพิ่มคู่แข่งรายใหญ่ในสนามที่บริษัทอย่าง Google และ Meta แสดงความคืบหน้าต่อสาธารณะแล้ว แต่ข้อสรุปที่ยืนยันได้ในตอนนี้ยังควรจำกัดอยู่เพียงว่า ByteDance ดูเหมือนกำลังเดินหน้าอย่างจริงจังกับเวิลด์โมเดลวิดีโอเชิงพื้นที่บนฐาน Seedance และมีจาง อี้หมิงให้ความสนใจโดยตรง ส่วนคุณภาพการใช้งานจริง วันเปิดตัว และผลกระทบต่อ Pico ยังพิสูจน์ไม่ได้จนกว่าบริษัทจะเปิดตัวผลิตภัณฑ์พร้อมผลวัดทางเทคนิค 1
7
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
ByteDance มีรายงานว่ากำลังเตรียมโมเดล AI ที่ต่อยอดจาก Seedance เพื่อสร้างวิดีโอเชิงพื้นที่และโลกเสมือนที่โต้ตอบได้ โดยอาจเปิดตัวเร็วที่สุดในเดือนตุลาคม 2026
ByteDance มีรายงานว่ากำลังเตรียมโมเดล AI ที่ต่อยอดจาก Seedance เพื่อสร้างวิดีโอเชิงพื้นที่และโลกเสมือนที่โต้ตอบได้ โดยอาจเปิดตัวเร็วที่สุดในเดือนตุลาคม 2026 รายงานเชื่อมโมเดลนี้กับไลฟ์สด ซีรีส์สั้น เกม และอาจรวมถึงเฮดเซ็ต Pico ส่วนตัวเลข 20 เฟรมต่อวินาทีและความหน่วงราว 0.05 วินาทียังเป็นข้อมูลที่รายงานอ้าง ไม่ใช่ผลทดสอบสาธารณะ
โครงการนี้จะพา ByteDance เข้าสู่การแข่งขันด้าน “เวิลด์โมเดล” หรือ AI ที่จำลองสภาพแวดล้อมซึ่งตอบสนองต่อการกระทำ แทนการสร้างคลิปวิดีโอทางเดียว