ByteDance forbereder ifølge meldinger en Seedance basert KI modell som kan lage interaktiv romlig video og virtuelle verdener. Modellen knyttes til direktesendinger, kortdramaer, spill og muligens Pico headset.
Publisert avRedigert med GPT-5.6 TerraBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is known about ByteDance’s reported real-time spatial video AI model—personally overseen by founder Zhang Yiming and potentially launch. Article summary: ByteDance is reportedly developing a Seedance-based real-time spatial-video, or “world model,” that could generate interactive 3D environments rather than conventional linear video. Zhang Yiming is said to be personally . Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
ByteDance utvikler angivelig et KI-system for å generere romlig video i sanntid – en type verdensmodell som skal lage interaktive, navigerbare digitale miljøer fremfor vanlige videoklipp med et fast start- og sluttpunkt. Bloomberg meldte at grunnlegger Zhang Yiming selv følger arbeidet tett, og at en lansering kan komme så tidlig som neste måned. Planen kan imidlertid endres, og ByteDance har ikke offentlig bekreftet prosjektet. 1
Den omtalte modellen skal være bygget på Seedance, ByteDances teknologi for videogenerering. Seedance 2.0 er en multimodal lyd- og videomodell som kan ta imot tekst, bilder, lyd og video som inndata, ifølge ByteDances eget lanseringsmateriale.
Målet skal være mer enn å generere en ferdig video. Modellen beskrives som et system for å lage interaktive virtuelle verdener til blant annet direktesendinger, kortdramaer og spill. 7 I praksis betyr det at en scene skal kunne reagere når en bruker beveger seg eller gjør noe i miljøet, i stedet for at brukeren bare ser en forhåndsgenerert sekvens.
Dette er grunnen til at teknologien omtales som en verdensmodell. Google DeepMind beskriver slike modeller som systemer som simulerer hvordan miljøer utvikler seg, og hvordan handlinger påvirker dem. DeepMinds Genie 3 er laget for å skape interaktive miljøer fra tekstinstruksjoner i sanntid.
Ifølge Bloombergs kilder koordinerer Zhang Yiming arbeidet på tvers av ByteDances forretningsområder og prioriterer KI-ressurser og regnekapasitet til prosjektet. 1 Det er ikke det samme som at produktet er ferdig eller at lansering er garantert. Men dersom opplysningene stemmer, tyder grunnleggerens direkte involvering på at ByteDance ser dette som en større plattformsatsing – ikke bare en ny videofunksjon.
Bloomberg plasserer initiativet i konkurransen med Meta og Alphabet, Googles morselskap, og peker på mulige bruksområder innen robotikk og autonome systemer i tillegg til underholdning. 1 Interaktivt innhold kan bli den nærmeste kommersielle anvendelsen, mens den langsiktige ambisjonen synes å være en modell som kan holde et digitalt miljø sammenhengende mens brukeren påvirker det.
En rapport som siterer kilder med kjennskap til prosjektet, hevder at modellen kan levere videostrømmer med rundt 20 bilder i sekundet og omtrent 0,05 sekunders forsinkelse. Den skal også kunne reagere på stemme- eller bevegelsesinndata fra brukere av Pico-headset. 7
Tallene må behandles med varsomhet. Dette er rapporterte påstander, ikke offentlige benchmarkresultater eller teknisk dokumentasjon fra ByteDance. For et XR-produkt – utvidet virkelighet, som omfatter VR og beslektede opplevelser – er ikke bildefrekvens alene nok. Bilde- og romstabilitet, nettverkskvalitet, forsinkelsen fra bevegelse til bilde og kostnaden ved KI-beregning vil alle avgjøre hvordan opplevelsen faktisk blir.
Skybasert rendering kan i teorien flytte noe av beregningen bort fra headsettet og dermed redusere behovet for kraftig lokal maskinvare. Men det er for tidlig å konkludere med at dette vil gjøre Pico-enheter billigere eller gi ByteDance et avgjørende overtak mot Meta eller Apple. Det er mulige strategiske følger, ikke bekreftede produktegenskaper.
Formuleringen «så tidlig som neste måned» bygger på anonyme kilder. Bloomberg skrev at produktet klargjøres for en mulig lansering, ikke at en endelig dato er annonsert. 1 Andre omtaler av saken understreker også at tidsplanen kan endres.
8
Frem til ByteDance selv legger fram produktet, er det nyttig å skille mellom:
ByteDance har betydelige ressurser til KI-infrastruktur, men det betyr ikke at pengene er øremerket denne modellen. Reuters meldte at selskapet sikret et lån på 29,6 milliarder dollar fra nær 30 banker. Kilder oppga at midlene skal støtte internasjonal KI-ekspansjon, og lånet skal ha vokst fra et opprinnelig mål på 20 milliarder dollar.
Bloomberg rapporterte dessuten at ByteDance vurderte investeringer på opptil 70 milliarder dollar i 2026 i datasentre og annen KI-infrastruktur. Dette var en rapportert planleggingsramme, ikke bekreftede utgifter eller en spesifikk bevilgning til verdensmodellen.
Rapporter basert på 36Kr har også oppgitt at ByteDance har som mål å lansere minst én verdensmodell før utgangen av 2026, med Google Genie 3 som referansepunkt. Også dette er rapporterte interne prioriteringer, ikke offentlige løfter fra selskapet.
KI-videomodeller kan allerede lage overbevisende klipp. Et interaktivt miljø krever noe langt vanskeligere: Systemet må bevare en sammenhengende scene over tid og få den til å reagere plausibelt på brukerens handlinger. Det er både hovedattraksjonen og den sentrale tekniske utfordringen ved verdensmodeller.
For ByteDance kan en vellykket modell knytte sammen selskapets videoteknologi med interaktiv underholdning og XR. For bransjen vil den gi Google og Meta enda en tung konkurrent i feltet. Foreløpig er den mest presise konklusjonen likevel begrenset: ByteDance ser ut til å jobbe seriøst med en Seedance-basert verdensmodell for romlig video, med Zhang Yimings rapporterte oppmerksomhet bak prosjektet. Kvaliteten i praksis, lanseringstidspunktet og betydningen for Pico er fortsatt uavklart til selskapet viser fram produktet og publiserer målbare tekniske resultater. 1
7
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
ByteDance forbereder ifølge meldinger en Seedance basert KI modell som kan lage interaktiv romlig video og virtuelle verdener.
ByteDance forbereder ifølge meldinger en Seedance basert KI modell som kan lage interaktiv romlig video og virtuelle verdener. Modellen knyttes til direktesendinger, kortdramaer, spill og muligens Pico headset.
Satsingen plasserer ByteDance i kappløpet om «verdensmodeller» – KI systemer som skal simulere miljøer brukeren kan bevege seg i og påvirke, ikke bare lage vanlige videoklipp.