O PixVerse R2 foi pensado para manter uma cena audiovisual gerada por IA em andamento, em vez de entregar apenas um vídeo fechado. É possível orientar uma sessão com texto, imagens de referência, áudio e ações; o modelo tenta levar em conta o que já aconteceu ao gerar a continuação.
Publicado porEditado com GPT-6 LunaImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What is AIsphere’s PixVerse R2, when was it released, and how does it let users create and explore continuous audiovisual worlds through tex. Article summary: AIsphere’s PixVerse R2 is a real-time audiovisual “world model”: instead of producing a finished video clip, it generates a scene that keeps running and responds to the user. AIsphere published an R2 technical overview i. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
O PixVerse R2, da AIsphere, parte de uma proposta diferente da geração tradicional de vídeo por IA: em vez de criar um clipe pronto a partir de um único comando, tenta manter uma cena em funcionamento e permitir que o usuário influencie o que acontece nela. A empresa anunciou o R2 em 22 de setembro de 2026; notícias sobre o lançamento formal na China datam a apresentação de 23 de setembro. A AIsphere havia publicado uma visão técnica do modelo em agosto. 1
5
9
A ideia é continuar orientando a mesma sessão, em vez de pedir um vídeo novo a cada mudança. Segundo a PixVerse, o R2 aceita texto, imagens de referência, áudio e comandos de ação. Relatos também descrevem controles de movimento no estilo WASD — teclas usadas para mover personagens em jogos de computador — e prompts que podem trocar um personagem, acrescentar um objeto ou modificar o ambiente enquanto a geração continua. 1
6
Cada novo comando deve influenciar tanto a cena atual quanto o que vem depois. Para isso, o modelo usa o estado e o histórico da sessão ao gerar os próximos trechos de áudio e vídeo. A AIsphere afirma que o R2 busca manter as relações entre personagens, objetos e espaços ao longo da interação. 1
3
6
Em Zero Mark, um filme-jogo interativo criado por Xiaolongbao, a mesma situação pode seguir caminhos diferentes conforme a escolha do jogador. Oferecer uma folha ou um dragão a uma criatura provoca respostas distintas, geradas durante a interação. A demonstração ilustra como uma decisão pode alterar a continuação da cena. 12
Outra demo apresenta Eve, uma personagem digital. Segundo um relato, ela responde a perguntas e a acontecimentos da história usando voz, personalidade, memória e o estado da relação com o jogador, com o objetivo de manter uma identidade consistente ao longo de várias trocas. São exemplos do tipo de interação que o sistema pretende oferecer, não avaliações independentes de sua confiabilidade em sessões longas. 6
A AIsphere descreve o R2 como uma arquitetura com dois componentes principais. O Omni Causal AR é a parte voltada à modelagem do mundo: processa diferentes tipos de entrada e faz a cena avançar ao longo do tempo, usando o estado atual como contexto para a próxima geração. Já o Real-Time Acceleration busca levar essas capacidades a uma operação interativa, em tempo real. 1
9
13
Outros mecanismos procuram lidar com ritmo, continuidade e custo computacional:
Em avaliações internas, a AIsphere afirma ter observado uma redução de 35,8% na deriva visual ao longo de uma sessão longa. O dado é informado pela empresa e não deve ser interpretado como uma medida independente de desempenho em todos os cenários. 2
As fontes disponíveis não trazem uma comparação independente equivalente de latência, taxa de quadros ou qualidade. Assim, embora a PixVerse apresente o R2 como um modelo em tempo real, desenvolvido para manter a consistência por mais tempo, as informações divulgadas não permitem concluir como ele se comporta em diferentes cenas, tipos de comando ou sessões prolongadas. As demos ajudam a entender a proposta, mas não comprovam, por si só, a confiabilidade do sistema em usos mais amplos. 1
3
A PixVerse apresentou o R1 em janeiro de 2026 como um primeiro passo rumo a vídeos gerados continuamente e com interação. O R2 é descrito como uma evolução dessa abordagem, com foco em aceitar mais tipos de entrada e manter o estado da cena por mais tempo. 14
18
O PixVerse Game Engine conecta vídeo generativo em tempo real a agentes de IA e mecânicas de jogo, como objetivos, regras e mudanças de estado. Isso aponta para experiências que vão além de assistir a um vídeo e permitem participar de um mundo que se transforma conforme as ações do usuário. 14
17
As fontes sustentam essa descrição da direção do produto, mas não oferecem uma citação suficientemente fundamentada para atribuir ao CEO Wang Changhu uma visão mais específica sobre mundos interativos.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
O PixVerse R2 foi pensado para manter uma cena audiovisual gerada por IA em andamento, em vez de entregar apenas um vídeo fechado.
O PixVerse R2 foi pensado para manter uma cena audiovisual gerada por IA em andamento, em vez de entregar apenas um vídeo fechado. É possível orientar uma sessão com texto, imagens de referência, áudio e ações; o modelo tenta levar em conta o que já aconteceu ao gerar a continuação.
A AIsphere reportou uma redução de 35,8% na deriva visual em sessões longas, mas o resultado vem de avaliações internas, não de um benchmark independente.