A ByteDance estaria preparando um modelo de IA baseado no Seedance para gerar vídeo espacial e ambientes virtuais interativos em tempo real, com possível lançamento a partir de outubro de 2026. Os usos relatados incluem transmissões ao vivo, dramas curtos e jogos.
Publicado porEditado com GPT-5.6 TerraImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What is known about ByteDance’s reported real-time spatial video AI model—personally overseen by founder Zhang Yiming and potentially launch. Article summary: ByteDance is reportedly developing a Seedance-based real-time spatial-video, or “world model,” that could generate interactive 3D environments rather than conventional linear video. Zhang Yiming is said to be personally . Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
A ByteDance estaria desenvolvendo um sistema de IA para geração de vídeo espacial em tempo real — um tipo de modelo de mundo (world model) voltado à criação de ambientes digitais interativos e navegáveis, em vez de vídeos lineares convencionais. Segundo a Bloomberg, o fundador Zhang Yiming supervisiona pessoalmente o trabalho, e o lançamento poderia ocorrer já no próximo mês. O cronograma, porém, pode mudar, e a ByteDance ainda não confirmou publicamente o projeto. 1
O novo modelo seria baseado no Seedance, tecnologia de geração de vídeo da ByteDance. O Seedance 2.0 é um modelo multimodal de áudio e vídeo que aceita texto, imagens, áudio e vídeo como entradas, segundo o material de lançamento da própria empresa.
A proposta relatada vai além de produzir um clipe pronto. O sistema permitiria criar mundos virtuais interativos para transmissões ao vivo, dramas curtos e jogos. 7 Na prática, a ambição parece ser gerar uma cena que responda ao deslocamento e às interações do usuário, em vez de uma sequência pré-renderizada que simplesmente começa e termina.
É essa diferença que coloca o projeto na categoria de modelo de mundo. O Google DeepMind define esses sistemas como IAs capazes de simular a evolução de um ambiente e os efeitos das ações nele. Seu Genie 3, por exemplo, foi projetado para criar ambientes interativos a partir de descrições de texto, em tempo real.
De acordo com a Bloomberg, Zhang coordena o trabalho entre diferentes unidades de negócio da ByteDance e estaria direcionando recursos de IA e capacidade computacional ao modelo. 1 Isso não significa que exista um produto concluído nem uma data de lançamento garantida. Mas, se a informação estiver correta, o envolvimento direto do fundador indica que a iniciativa pode ser vista como um esforço de plataforma, e não apenas como mais um recurso de criação de vídeo por IA.
A Bloomberg enquadrou a iniciativa na disputa da ByteDance com Meta e Alphabet, controladora do Google, em uma área com aplicações que podem ir além do entretenimento, incluindo robótica e sistemas autônomos. 1 A mídia interativa pode ser o uso comercial mais próximo, enquanto a ambição técnica mais ampla é manter um ambiente digital utilizável mesmo quando as ações do usuário o alteram.
Uma reportagem, citando pessoas familiarizadas com o projeto, afirma que o modelo poderia gerar fluxos de vídeo a cerca de 20 quadros por segundo e com aproximadamente 0,05 segundo de latência. A mesma fonte diz que o sistema poderia responder a comandos de voz ou movimentos de usuários dos headsets Pico, divisão de realidade estendida (XR) da ByteDance. 7
Esses dados exigem cautela. São alegações reportadas, não resultados de testes públicos e independentes, e a ByteDance não divulgou documentação técnica que os comprove. Um produto de realidade estendida em tempo real também dependeria de outros fatores: estabilidade da imagem, consistência espacial, confiabilidade da rede, latência entre movimento e imagem exibida e custo de inferência.
Em tese, a renderização em nuvem poderia tirar parte do processamento do headset e reduzir a exigência sobre o hardware local. Ainda é cedo, porém, para concluir que o modelo diminuirá o preço do Pico ou dará à ByteDance uma vantagem decisiva sobre Meta ou Apple. Essas são implicações estratégicas possíveis, não resultados de produto confirmados.
A previsão de chegada “já no próximo mês” vem de fontes anônimas. A Bloomberg informou que o produto está sendo preparado para um possível lançamento, e não que há uma data fixa anunciada. 1 Outras reportagens que repercutiram a informação também destacam que o calendário pode mudar.
8
Até que a ByteDance faça um anúncio oficial, vale separar três camadas de informação:
A ByteDance dispõe de recursos expressivos para infraestrutura de IA, embora eles não constituam um orçamento exclusivo para esse modelo. A Reuters informou que a empresa obteve um empréstimo de US$ 29,6 bilhões de quase 30 bancos; segundo fontes ouvidas pela agência, os recursos apoiariam a expansão internacional de IA. A operação teria crescido a partir de uma meta inicial de US$ 20 bilhões.
Separadamente, a Bloomberg noticiou que a ByteDance avaliava despesas de capital de até US$ 70 bilhões em 2026 para data centers e outras infraestruturas de IA. Trata-se de uma cifra de planejamento reportada, não de gasto confirmado nem de uma alocação específica para este modelo.
Reportagens baseadas na cobertura do 36Kr também afirmam que a ByteDance definiu como meta lançar ao menos um modelo de mundo até o fim de 2026 e compará-lo ao Genie 3, do Google. São prioridades internas reportadas, e não compromissos públicos da empresa.
Modelos de vídeo por IA já conseguem criar clipes bastante convincentes. Um ambiente interativo, no entanto, exige algo mais difícil: preservar uma cena coerente ao longo do tempo e fazê-la reagir de maneira plausível aos comandos. Esse é, ao mesmo tempo, o atrativo e o desafio técnico dos modelos de mundo.
Para a ByteDance, um sistema bem-sucedido poderia conectar seu trabalho em geração de vídeo a entretenimento interativo e realidade estendida. Para o setor, acrescentaria um concorrente de peso a uma corrida que tem Google e Meta entre seus nomes mais visíveis.
Por enquanto, a conclusão mais segura é limitada: a ByteDance parece perseguir seriamente um modelo de mundo para vídeo espacial, construído sobre o Seedance e com a atenção relatada de Zhang Yiming. A qualidade prática, a data de lançamento e o impacto sobre o Pico continuarão em aberto até que a empresa apresente o produto e resultados técnicos mensuráveis. 1
7
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
A ByteDance estaria preparando um modelo de IA baseado no Seedance para gerar vídeo espacial e ambientes virtuais interativos em tempo real, com possível lançamento a partir de outubro de 2026.
A ByteDance estaria preparando um modelo de IA baseado no Seedance para gerar vídeo espacial e ambientes virtuais interativos em tempo real, com possível lançamento a partir de outubro de 2026. Os usos relatados incluem transmissões ao vivo, dramas curtos e jogos. Também há menções ao headset Pico, mas integração comercial e requisitos de hardware não foram confirmados.
Números de cerca de 20 quadros por segundo e 0,05 segundo de latência foram reportados por fontes não identificadas; não há benchmark técnico público que os valide.