Seedance 2.0 se lanzó en China el 12 de febrero de 2026 y puede combinar texto, imágenes, vídeo y audio para generar clips de hasta unos 15 segundos. Su principal diferencia es el control multimodal, no una ventaja general de calidad demostrada: frente a Sora 2, Veo 3.1 y Kling 3.0, destaca sobre todo en escenas dir...
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What is ByteDance’s Seedance 2.0 AI video-generation model, when and where was it launched, how does it compare with models such as OpenAI’s. Article summary: ByteDance’s Seedance 2.0 is a multimodal generative-video system: users can combine text prompts with reference images, video and audio to produce short, cinematic clips with synchronized dialogue, sound effects and lip . Topic tags: general, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers
Seedance 2.0 es un modelo multimodal de generación de vídeo desarrollado por ByteDance. Puede recibir una combinación de instrucciones de texto, imágenes, vídeos y audio para crear clips cortos con personajes, acción, movimientos de cámara, diálogos, efectos de sonido y sincronización labial coordinados en una misma generación. Los informes sitúan la duración de los clips en hasta unos 15 segundos. 37
El modelo se lanzó en China el 12 de febrero de 2026, presuntamente a través de Jimeng AI, el servicio de ByteDance orientado al mercado chino. En un primer momento no fue un producto internacional de disponibilidad general, aunque su posible conexión con el ecosistema de edición de vídeo de la compañía hizo que su distribución potencial cobrara especial importancia. 37
Muchas herramientas de vídeo generativo parten de un prompt de texto o de unas pocas referencias visuales. La propuesta distintiva de Seedance es combinar varias clases de entrada y asignarles funciones dentro de una escena. Por ejemplo, una imagen puede orientar el aspecto de un personaje, un vídeo puede influir en su movimiento y un archivo de audio puede marcar el diálogo o el ambiente sonoro, mientras el usuario describe la secuencia en lenguaje natural. 71718
Ese enfoque resulta especialmente útil para trabajos guiados por referencias: storyboards, videoclips, contenido para redes sociales, pruebas de personajes y escenas breves basadas en material visual existente. La diferencia no está únicamente en que el resultado pueda parecer realista, sino en que el creador dispone de un control más directo sobre lo que aparece y sobre la relación entre los distintos elementos de la escena.
No existe un benchmark independiente y ampliamente aceptado que demuestre que Seedance 2.0 sea, en términos generales, el mejor modelo de vídeo con IA. Las comparativas publicadas utilizan prompts, configuraciones y criterios de evaluación diferentes, por lo que conviene desconfiar de los rankings absolutos. 61718
Una comparación práctica resulta más útil:
Estas descripciones son tendencias de producción, no veredictos definitivos. La elección depende de si el usuario prioriza el control de referencias, el acabado cinematográfico, el movimiento, el audio, la resolución, la duración, la integración con su flujo de trabajo o el coste.
DeepSeek no es un modelo de generación de vídeo directamente comparable. La expresión «el momento DeepSeek de Hollywood» funciona como una analogía: resume el temor de que una empresa china pueda ofrecer con rapidez un sistema creativo de IA capaz y relativamente barato, distribuirlo a escala de consumo y alterar una industria estadounidense consolidada.
En el debate sobre Seedance, la preocupación iba más allá de la competencia entre modelos. También incluía la posibilidad de reproducir a bajo coste personajes reconocibles, parecidos de celebridades, voces y actuaciones antes de que las normas de copyright, los derechos de imagen y las protecciones laborales pudieran responder plenamente.
La demostración más comentada fue un clip de unos 15 segundos en el que unas versiones aparentemente generadas por IA de Tom Cruise y Brad Pitt se enfrentaban sobre una azotea deteriorada. El cineasta irlandés Ruairi Robinson afirmó que había creado el vídeo con un prompt de dos líneas en Seedance. Los rostros, la coreografía, la puesta en escena y las actuaciones aparentes hicieron que el resultado se pareciera inusualmente a una secuencia de acción convencional. 2312
El vídeo se convirtió en un punto de inflexión porque reunía varias capacidades que hasta entonces se habían tratado por separado: personas reconocibles, acción física plausible, composición cinematográfica y una actuación o diálogo aparente. No demostraba que Cruise o Pitt hubieran participado en la escena ni que la hubieran autorizado; se trataba de una imitación de sus parecidos aparentes.
También circularon ampliamente ejemplos atribuidos a Seedance en los que aparecían personajes protegidos reconocibles, como Spider-Man y Deadpool. Reportajes y publicaciones en internet describieron además imitaciones relacionadas con películas, series de televisión, anime, videojuegos y figuras famosas. 1710
Hay, no obstante, un límite importante en la evidencia. Las publicaciones virales no constituyen un registro forense fiable del modelo que produjo cada vídeo. Algunos clips pueden estar mal etiquetados, editados o creados con varias herramientas. La conclusión más sólida es más concreta: se informó de que Seedance hacía accesibles mediante prompts sencillos parecidos, voces y actuaciones sintéticas muy convincentes, lo que elevó la preocupación por los contenidos no autorizados a una nueva escala.
La reacción se concentró en tres riesgos relacionados entre sí.
Aparentemente, los usuarios podían generar escenas con personajes protegidos y mundos de ficción reconocibles. La Motion Picture Association (MPA), la asociación que representa a los grandes estudios cinematográficos estadounidenses, afirmó que Seedance había utilizado obras protegidas por copyright de Estados Unidos sin autorización y a una escala masiva, y pidió a ByteDance que detuviera la presunta infracción. 8912
La disputa no gira simplemente en torno a si un resultado se parece a un género conocido. La cuestión central es si un sistema permite reproducir personajes, escenas o elementos expresivos protegidos sin autorización y a una escala que los mecanismos tradicionales de control no pueden contener fácilmente.
Un rostro o una voz generados por IA pueden afectar derechos distintos del copyright. Intérpretes y sus representantes han planteado dudas sobre el consentimiento, la compensación y el uso de la identidad de una persona en una actuación sintética.
SAG-AFTRA, el sindicato estadounidense que representa a actores, locutores, bailarines, presentadores y otros profesionales, condenó lo que describió como un uso no autorizado de las voces y los parecidos de sus miembros. La organización calificó la práctica de inaceptable y advirtió de que podía perjudicar la capacidad de los profesionales humanos para ganarse la vida. 512
El temor económico es que unos pocos prompts y referencias permitan producir tráileres plausibles, anuncios, derivados para redes sociales o conceptos de escenas a un coste muy bajo. Eso no demuestra que la IA vaya a sustituir un empleo o una producción concretos, pero explica por qué el debate pasó rápidamente de la calidad del modelo a convertirse en un conflicto laboral y cultural.
La prueba de Robinson se convirtió en el ejemplo más visible, mientras que el guionista Rhett Reese expresó públicamente su alarma por las posibles consecuencias de la tecnología para escritores y cineastas. 469
SAG-AFTRA respaldó las críticas de los estudios y puso el foco en el uso no autorizado de voces y parecidos. La MPA exigió medidas más contundentes frente a la presunta infracción del copyright. Disney y Paramount estuvieron entre los estudios que, según los informes, objetaron a Seedance y a su aparente capacidad para generar personajes protegidos o parecidos de celebridades. 11241
La Human Artistry Campaign también apareció citada en la cobertura de la controversia. Su postura general sostiene que los artistas deberían conservar un consentimiento significativo y recibir reconocimiento y compensación cuando su identidad, voz, imagen u obra se utilizan en sistemas de IA. El material disponible no acredita una declaración más específica de la campaña sobre Seedance, por lo que conviene mantener la atribución en ese nivel general. 2
ByteDance afirmó inicialmente que reforzaría sus salvaguardas existentes y que trabajaría para impedir que los usuarios utilizaran sin autorización propiedad intelectual o parecidos personales. 103940
Informaciones posteriores describieron medidas adicionales: bloquear la generación a partir de imágenes o vídeos que contuvieran rostros reales, impedir en CapCut la creación no autorizada de personajes protegidos y añadir marcas de procedencia visibles e integradas en los resultados generados. 37
La posible integración con CapCut es relevante porque la aplicación forma parte de un flujo de edición de consumo muy extendido, no de una demostración especializada de laboratorio. Si un modelo potente de vídeo se incorpora a un editor utilizado habitualmente, la generación puede pasar de ser un experimento aislado a convertirse en una práctica cotidiana para producir contenido en redes sociales. Eso amplía tanto la oportunidad creativa como la importancia de que las salvaguardas funcionen.
El 17 de agosto de 2026, ByteDance y la Motion Picture Association anunciaron un acuerdo para reforzar las protecciones de copyright en los modelos de generación de vídeo e imágenes de ByteDance, incluidos Seedance y Seedream. 333435
El acuerdo supone un cambio relevante en la relación entre ByteDance y Hollywood, pero no resuelve por sí solo todas las cuestiones de fondo. No establece cómo se obtuvieron los datos de entrenamiento, no garantiza que los filtros no puedan eludirse ni determina cómo deben consentir los intérpretes los usos sintéticos de su identidad o cómo deberían ser compensados.
La importancia de Seedance 2.0 no reside tanto en demostrar que un modelo ha derrotado a todos sus rivales como en mostrar la rapidez con la que la generación multimodal de vídeo puede reunir realismo visual, dirección, sonido e identidades reconocibles.
Para los creadores, el modelo apunta hacia una producción de formato corto más controlable y flexible. Para estudios e intérpretes, los vídeos virales dejaron claro lo fácil que puede resultar convertir personajes protegidos y actuaciones humanas aparentes en materia prima para la experimentación pública. Y para reguladores y plataformas, el episodio subrayó que la capacidad del modelo, su distribución y la protección de derechos deben analizarse juntas, no una por una.
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
Seedance 2.0 se lanzó en China el 12 de febrero de 2026 y puede combinar texto, imágenes, vídeo y audio para generar clips de hasta unos 15 segundos.
Seedance 2.0 se lanzó en China el 12 de febrero de 2026 y puede combinar texto, imágenes, vídeo y audio para generar clips de hasta unos 15 segundos. Su principal diferencia es el control multimodal, no una ventaja general de calidad demostrada: frente a Sora 2, Veo 3.1 y Kling 3.0, destaca sobre todo en escenas dirigidas a partir de referencias.
ByteDance prometió reforzar sus salvaguardas tras las críticas y el 17 de agosto de 2026 acordó con la Motion Picture Association mejorar la protección del copyright en sus herramientas de vídeo e imagen.