Seedance 2.0 ra mắt tại Trung Quốc ngày 12/2/2026, có thể kết hợp văn bản, hình ảnh, video và âm thanh để tạo các clip dài khoảng 15 giây. Điểm khác biệt chính của mô hình là khả năng kiểm soát cảnh bằng nhiều loại tư liệu tham chiếu, thay vì chỉ dựa vào câu lệnh văn bản.
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What is ByteDance’s Seedance 2.0 AI video-generation model, when and where was it launched, how does it compare with models such as OpenAI’s. Article summary: ByteDance’s Seedance 2.0 is a multimodal generative-video system: users can combine text prompts with reference images, video and audio to produce short, cinematic clips with synchronized dialogue, sound effects and lip . Topic tags: general, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers
Seedance 2.0 là mô hình tạo video AI đa phương thức của ByteDance, công ty đứng sau TikTok. Người dùng có thể đưa vào cùng lúc câu lệnh văn bản, hình ảnh, video tham chiếu và âm thanh. Hệ thống sau đó tạo ra các đoạn clip ngắn với nhân vật, chuyển động, góc máy, lời thoại, hiệu ứng âm thanh và khẩu hình được phối hợp trong một lần sinh nội dung. Các báo cáo cho biết video có thể dài tối đa khoảng 15 giây. 37
Mô hình được phát hành tại Trung Quốc ngày 12/2/2026, được cho là thông qua Jimeng AI—dịch vụ AI hướng tới thị trường Trung Quốc của ByteDance. Ban đầu, Seedance 2.0 chưa phải sản phẩm quốc tế được cung cấp rộng rãi. Tuy nhiên, khả năng được đưa vào hệ sinh thái chỉnh sửa video dành cho người dùng phổ thông khiến câu chuyện phân phối của nó trở nên đặc biệt đáng chú ý. 37
Nhiều công cụ video AI bắt đầu từ một câu lệnh văn bản hoặc một vài ảnh tham chiếu. Điểm nhấn của Seedance 2.0 là cho phép người dùng kết hợp nhiều loại đầu vào và chỉ định vai trò của từng tư liệu trong cảnh.
Chẳng hạn, hình ảnh có thể định hướng ngoại hình nhân vật, video tham chiếu giúp gợi ý chuyển động, còn âm thanh định hình lời nói hoặc bầu không khí. Người dùng có thể mô tả trình tự mong muốn bằng ngôn ngữ tự nhiên, rồi yêu cầu hệ thống tạo ra cảnh có hành động, chuyển cảnh, chuyển động máy quay, thoại và âm thanh tương ứng. 71718
Cách tiếp cận này phù hợp với các dự án dựa trên tư liệu tham chiếu như storyboard, video âm nhạc, nội dung mạng xã hội, thử nghiệm nhân vật hay những cảnh ngắn phát triển từ hình ảnh có sẵn.
Điểm quan trọng không chỉ nằm ở việc video trông chân thực đến đâu. Seedance được chú ý vì hứa hẹn cho người dùng quyền kiểm soát trực tiếp hơn đối với những gì xuất hiện trong cảnh và mối liên hệ giữa các thành phần của cảnh đó.
Hiện chưa có một bài kiểm định độc lập, thống nhất và được chấp nhận rộng rãi nào chứng minh Seedance 2.0 là mô hình video AI tốt nhất về mọi mặt. Các phép so sánh công khai thường dùng câu lệnh, thiết lập và tiêu chí đánh giá khác nhau, vì vậy những tuyên bố về một “quán quân tuyệt đối” cần được xem xét thận trọng. 61718
Có thể hình dung khác biệt giữa các mô hình theo xu hướng sử dụng như sau:
Đây là các xu hướng trong quy trình sản xuất, không phải bảng xếp hạng cố định. Lựa chọn phù hợp còn phụ thuộc vào việc người sáng tạo ưu tiên kiểm soát tư liệu tham chiếu, chất điện ảnh, chuyển động, âm thanh, độ phân giải, thời lượng, khả năng tích hợp vào quy trình hay chi phí.
DeepSeek không phải mô hình tạo video nên không thể so sánh trực tiếp với Seedance 2.0. Cụm từ “khoảnh khắc DeepSeek của Hollywood” chỉ là một phép ẩn dụ: nó diễn tả nỗi lo rằng một công ty AI Trung Quốc có thể tạo ra hệ thống sáng tạo vừa đủ năng lực, chi phí thấp và nhanh chóng tiếp cận người dùng đại chúng—từ đó gây sức ép lên một ngành công nghiệp Mỹ đã tồn tại lâu năm.
Trong tranh luận về Seedance, nỗi lo còn vượt ra ngoài cuộc đua giữa các mô hình. Hollywood và giới nghệ sĩ quan tâm đến khả năng nhân vật nổi tiếng, gương mặt, giọng nói và màn trình diễn của con người bị tái tạo với chi phí thấp, trước khi luật bản quyền, quyền hình ảnh và cơ chế bảo vệ người lao động kịp thích ứng.
Ví dụ gây chú ý nhất là đoạn clip dài khoảng 15 giây, cho thấy hình ảnh giống Tom Cruise và Brad Pitt giao chiến trên một mái nhà đang xuống cấp. Đạo diễn người Ireland Ruairi Robinson cho biết video được tạo từ một câu lệnh Seedance chỉ gồm hai dòng. Gương mặt, vũ đạo, bố cục và màn trình diễn trông giống một cảnh phim hành động truyền thống đến mức bất ngờ. 2312
Đoạn clip trở thành điểm bùng phát tranh cãi vì nó kết hợp nhiều năng lực vốn thường được thảo luận riêng rẽ: nhân vật có thể nhận diện, hành động vật lý thuyết phục, bố cục điện ảnh và phần thể hiện giống lời thoại hoặc diễn xuất.
Tuy nhiên, video không cho thấy Cruise hay Pitt đã tham gia hoặc cho phép thực hiện cảnh này. Đây là một sản phẩm mô phỏng hình ảnh giống họ, không phải màn trình diễn có sự ủy quyền của hai diễn viên.
Nhiều ví dụ khác được lan truyền và gắn với Seedance có các nhân vật bản quyền dễ nhận biết như Spider-Man và Deadpool. Các bài viết và bài đăng trên mạng cũng mô tả những video dường như mô phỏng phim điện ảnh, chương trình truyền hình, anime, trò chơi điện tử và người nổi tiếng. 1710
Dù vậy, cần giữ một giới hạn quan trọng về bằng chứng: các bài đăng lan truyền không phải hồ sơ pháp chứng đáng tin cậy để xác định chính xác mô hình nào đã tạo ra từng video. Một số clip có thể bị gắn nhãn sai, đã qua chỉnh sửa hoặc được tạo bằng nhiều công cụ.
Kết luận chắc chắn hơn là Seedance được cho là đã khiến những hình ảnh, giọng nói và màn trình diễn giống người thật trở nên dễ tiếp cận qua các câu lệnh đơn giản, qua đó làm gia tăng đáng kể lo ngại về nội dung tổng hợp không được cho phép.
Phản ứng dữ dội tập trung vào ba nhóm rủi ro chồng lấn lên nhau.
Người dùng dường như có thể tạo cảnh với các nhân vật được bảo hộ và những thế giới hư cấu dễ nhận biết. Hiệp hội Điện ảnh Mỹ (Motion Picture Association—MPA), tổ chức đại diện cho các hãng phim lớn tại Mỹ, cáo buộc Seedance đã sử dụng trái phép các tác phẩm có bản quyền của Mỹ trên quy mô lớn và yêu cầu ByteDance chấm dứt hành vi bị cho là vi phạm. 8912
Tranh chấp cốt lõi không chỉ là việc một video gợi nhớ đến một thể loại quen thuộc. Vấn đề là liệu công cụ có cho phép người dùng tái tạo nhân vật, cảnh phim hoặc các yếu tố biểu đạt được bảo hộ mà không xin phép, ở quy mô lớn đến mức các biện pháp thực thi truyền thống khó kiểm soát hay không.
Một gương mặt hoặc giọng nói được tạo bằng AI có thể liên quan đến những quyền lợi khác với bản quyền. Diễn viên và đại diện của họ đặt câu hỏi về sự đồng thuận, thù lao và việc danh tính cá nhân bị sử dụng trong một màn trình diễn tổng hợp.
SAG-AFTRA, công đoàn đại diện cho các diễn viên, phát thanh viên, vũ công, người dẫn chương trình và nhiều nhóm nghệ sĩ biểu diễn tại Mỹ, lên án điều tổ chức này mô tả là việc sử dụng trái phép giọng nói và hình ảnh của thành viên. Công đoàn gọi đây là hành vi không thể chấp nhận và cảnh báo nó có thể làm suy yếu khả năng kiếm sống của nhân tài con người. 512
Nỗi lo kinh tế xuất phát từ khả năng chỉ cần vài câu lệnh và tư liệu tham chiếu là có thể tạo ra trailer, quảng cáo, video mạng xã hội hoặc ý tưởng cảnh phim với chi phí rất thấp.
Điều đó chưa chứng minh AI sẽ thay thế một công việc hay dự án cụ thể. Nhưng nó giải thích vì sao tranh cãi nhanh chóng chuyển từ câu chuyện chất lượng mô hình sang cuộc đối đầu về lao động và quyền lợi của ngành sáng tạo.
Thử nghiệm của Robinson trở thành ví dụ nổi bật nhất. Biên kịch Rhett Reese, đồng tác giả kịch bản Deadpool & Wolverine và Zombieland, cũng công khai bày tỏ lo ngại về tác động của công nghệ đối với biên kịch và nhà làm phim. 469
SAG-AFTRA đứng cùng các hãng phim trong việc chỉ trích công cụ, tập trung vào việc sử dụng giọng nói và hình ảnh giống diễn viên mà không được cho phép. MPA yêu cầu ByteDance có hành động mạnh hơn trước những cáo buộc vi phạm bản quyền. Disney và Paramount cũng được đưa tin là đã phản đối Seedance cùng khả năng tạo nhân vật bản quyền hoặc hình ảnh giống người nổi tiếng của công cụ này. 11241
Human Artistry Campaign—một liên minh quốc tế vận động cho việc sử dụng AI tôn trọng nghệ sĩ, nghệ sĩ biểu diễn và người sáng tạo—được nhắc đến trong các bài viết về tranh cãi. Quan điểm chung của tổ chức này là nghệ sĩ cần có quyền đồng thuận, được ghi nhận và được trả thù lao có ý nghĩa khi danh tính, giọng nói, hình ảnh hoặc tác phẩm của họ được dùng trong các hệ thống AI. Các tài liệu hiện có không xác lập một tuyên bố cụ thể hơn của chiến dịch liên quan riêng đến Seedance, vì vậy không nên diễn giải vượt quá mức này. 2
Sau phản ứng dữ dội, ByteDance cho biết sẽ tăng cường các cơ chế bảo vệ hiện có và tìm cách ngăn người dùng sử dụng trái phép tài sản trí tuệ cũng như hình ảnh của người khác. 103940
Các thông tin được công bố sau đó mô tả thêm một số biện pháp: chặn việc tạo video từ hình ảnh hoặc video có khuôn mặt thật, ngăn CapCut tạo trái phép các nhân vật có bản quyền, đồng thời bổ sung dấu nhận diện nguồn gốc cả dạng nhìn thấy được lẫn được nhúng trong tệp đầu ra. 37
Việc Seedance có thể được kết nối với CapCut rất đáng chú ý. CapCut là một ứng dụng chỉnh sửa video phổ biến, không chỉ là bản trình diễn dành cho các nhà nghiên cứu hay người dùng chuyên nghiệp. Nếu một mô hình mạnh được tích hợp vào công cụ chỉnh sửa quen thuộc, việc tạo video AI có thể chuyển từ các thử nghiệm riêng lẻ thành hoạt động thường nhật trên mạng xã hội.
Điều này mở rộng cơ hội sáng tạo, nhưng đồng thời khiến hiệu quả của các biện pháp bảo vệ trở nên quan trọng hơn. Ngày 17/8/2026, ByteDance và MPA thông báo đã đạt thỏa thuận nhằm tăng cường bảo vệ bản quyền cho các mô hình tạo video và hình ảnh AI của ByteDance, trong đó có Seedance và Seedream. 333435
Thỏa thuận đánh dấu một thay đổi đáng kể trong quan hệ giữa ByteDance và Hollywood, nhưng chưa tự nó giải quyết mọi câu hỏi nền tảng. Văn bản này không xác định dữ liệu huấn luyện được thu thập như thế nào, không bảo đảm các bộ lọc không thể bị vượt qua, cũng không quyết định diễn viên phải đồng ý và được trả thù lao ra sao khi danh tính của họ được dùng trong nội dung tổng hợp.
Tầm quan trọng của Seedance 2.0 không nằm ở việc chứng minh một mô hình đã đánh bại mọi đối thủ. Điều đáng chú ý hơn là nó cho thấy video AI có thể nhanh chóng kết hợp độ chân thực hình ảnh, khả năng chỉ đạo cảnh, âm thanh và danh tính dễ nhận biết của con người.
Với người sáng tạo, mô hình mở ra hướng sản xuất nội dung ngắn có khả năng kiểm soát cao hơn. Với hãng phim và diễn viên, các video lan truyền cho thấy nhân vật bản quyền và màn trình diễn có vẻ là của người thật có thể dễ dàng trở thành nguyên liệu cho những thử nghiệm công khai.
Còn với cơ quan quản lý và các nền tảng, sự việc nhấn mạnh một điều: năng lực mô hình, khả năng phân phối và bảo vệ quyền lợi phải được xem xét cùng nhau, thay vì giải quyết từng vấn đề một cách tách rời.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Seedance 2.0 ra mắt tại Trung Quốc ngày 12/2/2026, có thể kết hợp văn bản, hình ảnh, video và âm thanh để tạo các clip dài khoảng 15 giây.
Seedance 2.0 ra mắt tại Trung Quốc ngày 12/2/2026, có thể kết hợp văn bản, hình ảnh, video và âm thanh để tạo các clip dài khoảng 15 giây. Điểm khác biệt chính của mô hình là khả năng kiểm soát cảnh bằng nhiều loại tư liệu tham chiếu, thay vì chỉ dựa vào câu lệnh văn bản.
Sau làn sóng phản đối, ByteDance tuyên bố tăng cường biện pháp bảo vệ; đến ngày 17/8/2026, công ty ký thỏa thuận với Hiệp hội Điện ảnh Mỹ (MPA) để củng cố các cơ chế bảo vệ bản quyền.