PixVerse R2 का मकसद एक तय वीडियो क्लिप देने के बजाय ऐसी ऑडियो वीडियो दुनिया चलाना है, जिसे उपयोगकर्ता बीच में निर्देश देकर बदल सके। यह टेक्स्ट, संदर्भ तस्वीरों, ऑडियो और ऐक्शन इनपुट को लेकर पात्रों, वस्तुओं और दृश्य की स्थिति को आगे बनाए रखने की कोशिश करता है। AIsphere ने अपने आंतरिक परीक्षणों में लंबे सत्र के दौरान...
प्रकाशितकर्ताGPT-6 Luna से संपादितGPT Image 2 से चित्र बनाए गए
शोध उत्तर

Create a landscape editorial hero image for this Studio Global article: What is AIsphere’s PixVerse R2, when was it released, and how does it let users create and explore continuous audiovisual worlds through tex. Article summary: AIsphere’s PixVerse R2 is a real-time audiovisual “world model”: instead of producing a finished video clip, it generates a scene that keeps running and responds to the user. AIsphere published an R2 technical overview i. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
PixVerse R2, AIsphere का ऐसा रियल-टाइम वर्ल्ड मॉडल है जो वीडियो को एक बार बनाकर वहीं खत्म नहीं करता। इसका विचार है कि दृश्य चलता रहे और उपयोगकर्ता टेक्स्ट, तस्वीर, ऑडियो या ऐक्शन के जरिए बीच में उसे दिशा दे सके। AIsphere ने R2 की घोषणा 22 सितंबर 2026 को की; चीन में औपचारिक लॉन्च की खबरें 23 सितंबर की हैं। कंपनी ने इसका तकनीकी विवरण अगस्त में प्रकाशित किया था। 1
5
9
आम AI वीडियो टूल में प्रॉम्प्ट देकर एक तैयार क्लिप मिलती है। PixVerse R2 में उपयोगकर्ता चल रहे सत्र को आगे भी प्रभावित कर सकता है। कंपनी के मुताबिक, इसमें टेक्स्ट, संदर्भ तस्वीरें, ऑडियो और ऐक्शन कंट्रोल इस्तेमाल किए जा सकते हैं। रिपोर्टों में WASD जैसे कीबोर्ड कंट्रोल से चलना और प्रॉम्प्ट देकर पात्र बदलना, कोई वस्तु जोड़ना या माहौल बदलना भी शामिल है। उद्देश्य यह है कि नया निर्देश उसी दृश्य में आगे क्या होगा, उसे बदले—न कि हर बार एक असंबद्ध क्लिप शुरू हो। 1
6
यही निरंतरता “वर्ल्ड मॉडल” की अवधारणा का अहम हिस्सा है। R2 का लक्ष्य सत्र में पहले हुई घटनाओं और मौजूदा कंट्रोल को ध्यान में रखकर अगला ऑडियो-वीडियो हिस्सा बनाना है। AIsphere का कहना है कि मॉडल सत्र की घटनाओं को आगे याद रखता है और पात्रों, वस्तुओं तथा जगहों के बीच संबंध बनाए रखने की कोशिश करता है। 1
3
6
Zero Mark नाम के इंटरैक्टिव फिल्म-गेम में, जिसे Xiaolongbao ने बनाया है, खिलाड़ी की पसंद से एक ही मुलाकात अलग दिशा ले सकती है। उदाहरण के लिए, किसी जीव को पत्ता देने के बजाय ड्रैगन देने पर उसकी प्रतिक्रिया बदल जाती है। यह दिखाता है कि इनपुट से दृश्य की अगली कड़ी प्रभावित हो सकती है। 12
एक अलग डेमो में Eve नाम का डिजिटल किरदार है। एक रिपोर्ट के अनुसार, Eve खिलाड़ी के सवालों और कहानी में हुए बदलावों के जवाब आवाज़, व्यक्तित्व, स्मृति और रिश्ते की स्थिति के आधार पर देती है। मकसद यह है कि कई संवादों के दौरान उसकी पहचान एक जैसी बनी रहे। ये डेमो इस तरह की बातचीत का उदाहरण हैं; वे यह साबित नहीं करते कि लंबे सत्रों में मॉडल हर बार कितनी भरोसेमंद तरह से ऐसा कर पाएगा। 6
AIsphere, R2 की तकनीक को दो मुख्य हिस्सों में समझाता है। Omni Causal AR वर्ल्ड-मॉडलिंग का हिस्सा है: यह अलग-अलग तरह के इनपुट संसाधित करके समय के साथ दृश्य को आगे बढ़ाता है और मौजूदा स्थिति को अगली कड़ी के संदर्भ के रूप में इस्तेमाल करता है। Real-Time Acceleration का मकसद इन क्षमताओं को इंटरैक्टिव गति से चलाना है। 1
9
13
समय, निरंतरता और कंप्यूटिंग की जरूरतों को संभालने के लिए इसमें कुछ और तकनीकें भी बताई गई हैं:
AIsphere ने अपने आंतरिक परीक्षणों में लंबे सत्र के दौरान दृश्य drift में 35.8% कमी दर्ज करने की बात कही है। यह कंपनी का अपना परिणाम है; इसे हर तरह के उपयोग में स्वतंत्र रूप से सत्यापित प्रदर्शन माप नहीं समझना चाहिए। 2
उपलब्ध स्रोतों में latency, फ्रेम रेट या गुणवत्ता की तुलना करने वाला समान स्तर का स्वतंत्र बेंचमार्क नहीं दिया गया है। इसलिए PixVerse R2 को रियल-टाइम और लंबे सत्रों में अधिक सुसंगत बनाने के लिए डिज़ाइन किया गया बताया जा सकता है, लेकिन यहाँ के साक्ष्य यह नहीं बताते कि अलग-अलग दृश्यों, कंट्रोल या बहुत लंबे सत्रों में यह कितना अच्छा चलेगा। डेमो अवधारणा दिखाते हैं; व्यापक उपयोग में इसकी विश्वसनीयता का फैसला नहीं करते। 1
3
PixVerse ने जनवरी 2026 में R1 पेश किया था, जिसे लगातार बनते और उपयोगकर्ता के साथ इंटरैक्ट करने वाले वीडियो की दिशा में शुरुआती कदम बताया गया। R2 को उसी विचार का उन्नत रूप कहा गया है, जिसमें अधिक तरह के इनपुट और लंबे समय तक दृश्य की स्थिति बनाए रखने पर जोर है। PixVerse Game Engine रियल-टाइम जनरेटिव वीडियो को AI एजेंटों और गेम के नियमों से जोड़ता है—यानी ऐसे अनुभवों की ओर, जहाँ भूमिकाएँ, नियम और दुनिया की बदलती स्थिति मायने रखती है। 14
18
उपलब्ध स्रोत PixVerse की इस उत्पाद-दिशा का वर्णन करने के लिए आधार देते हैं, लेकिन CEO Wang Changhu के नाम से इंटरैक्टिव दुनिया पर कोई अधिक विशिष्ट दृष्टि या उद्धरण देने के लिए पर्याप्त पुष्टि नहीं देते।
Studio Global AI
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
PixVerse R2 का मकसद एक तय वीडियो क्लिप देने के बजाय ऐसी ऑडियो वीडियो दुनिया चलाना है, जिसे उपयोगकर्ता बीच में निर्देश देकर बदल सके।
PixVerse R2 का मकसद एक तय वीडियो क्लिप देने के बजाय ऐसी ऑडियो वीडियो दुनिया चलाना है, जिसे उपयोगकर्ता बीच में निर्देश देकर बदल सके। यह टेक्स्ट, संदर्भ तस्वीरों, ऑडियो और ऐक्शन इनपुट को लेकर पात्रों, वस्तुओं और दृश्य की स्थिति को आगे बनाए रखने की कोशिश करता है।
AIsphere ने अपने आंतरिक परीक्षणों में लंबे सत्र के दौरान दृश्य में होने वाले बदलाव यानी visual drift में 35.8% कमी की बात कही है; यह स्वतंत्र बेंचमार्क नहीं है।