Google har rullet ut direkte bildegenerering og redigering inne i Gemini Live, selskapets konversasjonsmodus for kunstig intelligens [8]. Under en Live samtale kan du aktivere kameradeling, rette telefonen mot et motiv og gi naturlige språkkommandoer for å lage eller redigere bilder på sparket [8].

Create a landscape editorial hero image for this Studio Global article: What real-time image generation and editing capability has Google added to Gemini Live, how does it work on Android and iOS, what technology. Article summary: ## What Google Added to Gemini Live. Topic tags: general, documentation, general web, user generated, education. Reference image context from search candidates: Reference image 1: visual subject "Google has begun the deployment of Gemini's innovative real-time AI video functionalities, enabling the platform to interpret visual input from a user's device" source context "Google's Gemini update that can tell you live what it sees through your camera is now rolling out - PhoneArena" Reference image 2: visual subject "Smartphones must have user-replaceable batteries by 2027. But not your iPhone. Here's why" source context "Google's Gemini update that can tell you l
Google har tatt et stort steg inn i den multimodale fremtiden. Forestill deg å snakke med telefonen din, peke kameraet mot et motiv og be den kunstige intelligensen om å lage et nytt bilde eller endre det du ser – alt i sanntid. Dette er ikke lenger science fiction, men virkelighet i Googles Gemini Live.
Teknikken bak er like imponerende som enkelheten i bruk. Google har rullet ut direkte sanntids bildegenerering og -redigering inne i Gemini Live, deres konversasjonsmodus for kunstig intelligens . Under en pågående Live-samtale kan du nå aktivere kameradeling, rette kameraet mot noe og gi muntlige instruksjoner – for eksempel «gjør denne vasen blå» eller «generer et bilde av en katt som sitter her på bordet». Resultatet vises direkte i samtalevinduet
.
Android:
Brukere kan starte Gemini Live og aktivere kameradelingsfunksjonen. Du viser Gemini et motiv, og ved hjelp av naturlig språk ber du modellen lage eller redigere et bilde – alt drevet av bildemodellen Gemini 2.5 Flash Image, internt kalt «Nano Banana» .
iOS:
Den samme grunnleggende funksjonaliteten er tilgjengelig: kameradeling kombinert med sanntids bildegenerering og -redigering i en løpende samtale. Per nå er det ingen spesifisert egen arbeidsflyt for iOS utover dette .
En viktig nyanse: Eksisterende bildegenerering og -redigering via Gemini 2.5 Flash Image er tilgjengelig gjennom tekstbaserte eller bildebaserte instruksjoner. Den nye Gemini Live-funksjonen bringer derimot hele denne skapelsesprosessen inn i en stemmestyrt sanntidssamtale med kameraet som øyne .
Under panseret ligger Gemini 2.5 Flash Image – ofte omtalt som Nano Banana. Google beskriver dette som sin toppmoderne modell for bildegenerering og -redigering. De viktigste egenskapene inkluderer:
Mens du tidligere måtte formulere presise tekstledetekster, kan du nå altså peke og prate. Dette viser hvordan Google sømløst fletter sammen tale, syn og kreativitet.
Avdukingen av Gemini Live sin nye bildefunksjon var bare én av mange store nyheter under årets utviklerkonferanse. Her er hovedtrekkene som bygger videre på momentet:
Gemini Omni – «Nano Banana for video»
Google presenterte Gemini Omni som en revolusjonerende modell som kan skape og redigere video fra praktisk talt hvilket som helst input – tekst, lyd, bilder eller eksisterende video . Målet er at du skal kunne lage og finpusse videoer gjennom en helt vanlig samtale, uten å måtte lære deg avansert redigeringsprogramvare
. Omni kombinerer Geminis intelligens med Googles generative mediemodeller for en ny dimensjon av verdensforståelse, multimodalitet og redigeringskontroll
.
Modellen forstår fysikk, bevarer karakterers utseende og scener på tvers av klipp, og lar deg gjøre alt fra å bytte ut objekter til å endre lyssetting – bare ved å fortelle Gemini hva du ønsker . Første versjon, kalt Gemini Omni Flash, ruller nå ut til abonnenter via Gemini-appen og Google Flow, i tillegg til gratis tilgang i YouTube Shorts
.
Gemini 3.5 Flash – lynrask intelligens
Google lanserte også Gemini 3.5 Flash som den nye standardmodellen i Gemini-appen og i Google Søks AI-modus . Selskapet hevder at den prosesserer tokens hele fire ganger raskere enn andre toppmodeller i samme klasse
. Dette er modellen som er spesialdesignet for agentbaserte oppgaver: flertrinns arbeidsflyter, koding og kompleks logisk planlegging, uten at ventetiden blir et problem
.
Kort oppsummert, her er de viktigste annonseringene:
Googles styrke, basert på disse lanseringene, ligger i en helhetlig, sanntids multimodal rørledning. De binder sammen samtale, kamerainput, bildegenerering og videoredigering på en måte som konkurrentene foreløpig ikke matcher .
Mens andre tilbyr separate verktøy for bilder og video, bygger Google en plattform der du peker, prater og skaper – uten å skifte app eller grensesnitt. Her er konkurransefortrinnet kort oppsummert:
Spørsmålet fremover er ikke lenger hva som er teknisk mulig, men hvor godt disse integrerte arbeidsflytene fungerer i praksis for den jevne bruker etter hvert som de rulles bredere ut. Én ting er sikkert: Med Gemini Live og Omni beveger Google seg fra å være en ren informasjonsleverandør til å bli et kreativt verktøy du snakker med.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Google har rullet ut direkte bildegenerering og redigering inne i Gemini Live, selskapets konversasjonsmodus for kunstig intelligens [8].
Google har rullet ut direkte bildegenerering og redigering inne i Gemini Live, selskapets konversasjonsmodus for kunstig intelligens [8]. Under en Live samtale kan du aktivere kameradeling, rette telefonen mot et motiv og gi naturlige språkkommandoer for å lage eller redigere bilder på sparket [8].
Resultatet genereres eller redigeres direkte i Live opplevelsen, noe som binder sammen sanntids samtale og visuell skapelse [8].