PixVerse R2 задумана не как генератор готовых роликов, а как модель, которая продолжает развивать сцену по мере взаимодействия с пользователем. Управлять происходящим можно текстом, изображениями, аудио и действиями; модель должна учитывать предысторию и сохранять связи между персонажами, предметами и окружением.
ОпубликовалОтредактировано с помощью GPT-6 LunaИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What is AIsphere’s PixVerse R2, when was it released, and how does it let users create and explore continuous audiovisual worlds through tex. Article summary: AIsphere’s PixVerse R2 is a real-time audiovisual “world model”: instead of producing a finished video clip, it generates a scene that keeps running and responds to the user. AIsphere published an R2 technical overview i. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
PixVerse R2 — попытка компании AIsphere превратить ИИ-видео из заранее смонтированного фрагмента в сцену, которая продолжает развиваться в ответ на действия пользователя. Во время сессии можно подавать новые команды, а модель — генерировать следующие синхронизированные аудио- и видеосегменты, опираясь на то, что уже произошло. AIsphere объявила R2 22 сентября 2026 года; сообщения о формальном запуске в Китае датируют его 23 сентября. Технический обзор компания опубликовала в августе. 1
5
9
Обычный генератор видео получает запрос и выдаёт готовый клип. R2 задумана иначе: пользователь может продолжать направлять уже запущенную сцену текстом, референсными изображениями, аудио и действиями. В опубликованных описаниях упоминаются и клавиатурные команды в стиле WASD, и промпты, которые меняют персонажа, добавляют предмет или преобразуют окружение прямо по ходу генерации. 1
6
Ключевая идея — не начинать новый ролик после каждой команды. R2 должна учитывать текущее состояние сцены и её историю, чтобы новые действия влияли и на происходящее сейчас, и на дальнейшее развитие. AIsphere утверждает, что модель переносит события через всю сессию и стремится сохранять отношения между персонажами, объектами и пространством. 1
3
6
В интерактивной киноигре Zero Mark, созданной автором Xiaolongbao, один и тот же эпизод может пойти по-разному в зависимости от выбора игрока. Если предложить существу дракона, а не лист, оно ответит иначе — так демонстрируется, как действие пользователя меняет продолжение сцены. 12
В другом демо центральный персонаж — цифровая героиня Eve. Согласно опубликованному описанию, она отвечает на вопросы игрока и реагирует на развитие истории, используя голос, заданный образ, память и состояние отношений. Цель — сохранять узнаваемую личность в нескольких последовательных обменах репликами. Однако демонстрация показывает предполагаемый формат взаимодействия, а не независимую проверку надёжности модели в долгих сессиях. 6
AIsphere описывает R2 как систему из двух основных компонентов. Omni Causal AR — базовая модель мира: она объединяет разные типы входных данных и последовательно развивает сцену, используя её состояние как контекст для следующего шага. Real-Time Acceleration призван перенести эти возможности в режим интерактивной работы. 1
9
13
Для согласования темпа, непрерывности и вычислительных затрат в системе описаны дополнительные механизмы:
В собственных оценках AIsphere сообщила о снижении визуального дрейфа на 35,8% в течение длительной сессии. Это внутренний результат компании, а не независимо подтверждённая оценка работы модели во всех сценариях. 2
В предоставленных источниках нет сопоставимого независимого бенчмарка задержки, частоты кадров или качества. Поэтому утверждения о работе в реальном времени и большей согласованности на длинных отрезках следует рассматривать как заявления AIsphere. Демо показывают принцип взаимодействия, но сами по себе не устанавливают, насколько надёжно модель справляется с разными сценами и длительными сессиями. 1
3
В январе 2026 года PixVerse представила R1 — более ранний шаг к непрерывно генерируемому интерактивному видео. R2 компания описывает как развитие этой идеи с более широким набором входных сигналов и более устойчивым состоянием сцены. PixVerse Game Engine соединяет генеративное видео в реальном времени с ИИ-агентами и игровыми механиками — например, целями, правилами и меняющимся состоянием мира. 14
18
Источники позволяют описать это направление развития продукта, но не дают достаточно надёжной цитаты, чтобы приписать генеральному директору Wang Changhu конкретное видение интерактивных миров.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
PixVerse R2 задумана не как генератор готовых роликов, а как модель, которая продолжает развивать сцену по мере взаимодействия с пользователем.
PixVerse R2 задумана не как генератор готовых роликов, а как модель, которая продолжает развивать сцену по мере взаимодействия с пользователем. Управлять происходящим можно текстом, изображениями, аудио и действиями; модель должна учитывать предысторию и сохранять связи между персонажами, предметами и окружением.
По внутренним оценкам AIsphere, визуальный дрейф в длительной сессии снизился на 35,8%.