Hvad Google har tilføjet: Gemini Live understøtter nu direkte realtidsgenerering og redigering af billeder via kamera deling og stemmekommandoer [8]. Sådan virker det: Peg telefonen mod et motiv, aktiver kameradeling i en Live samtale, og giv instrukser på naturligt sprog for at generere eller redigere billeder dire...

Create a landscape editorial hero image for this Studio Global article: What real-time image generation and editing capability has Google added to Gemini Live, how does it work on Android and iOS, what technology. Article summary: ## What Google Added to Gemini Live. Topic tags: general, documentation, general web, user generated, education. Reference image context from search candidates: Reference image 1: visual subject "Google has begun the deployment of Gemini's innovative real-time AI video functionalities, enabling the platform to interpret visual input from a user's device" source context "Google's Gemini update that can tell you live what it sees through your camera is now rolling out - PhoneArena" Reference image 2: visual subject "Smartphones must have user-replaceable batteries by 2027. But not your iPhone. Here's why" source context "Google's Gemini update that can tell you l
Google har rullet direkte realtidsgenerering og -redigering af billeder ud i Gemini Live – Googles konverserende AI-tilstand . Under en igangværende Live-samtale kan du aktivere kameradeling, pege din telefon mod et motiv og give instrukser på almindeligt dansk (eller et hvilket som helst andet understøttet sprog) for at generere eller redigere billeder på stedet. Det færdige billede bliver genereret eller redigeret direkte inde i Live-oplevelsen, så du slipper for at skifte mellem apps eller værktøjer
.
Det er en markant ændring fra tidligere, hvor billedgenerering typisk krævede, at du skrev en prompt i chatten . Nu kan du ganske enkelt vise Gemini, hvad du ser, og sige, hvad du vil have – og få resultatet med det samme.
Funktionen er ifølge Google rullet ud til Gemini-appen på både Android og iOS .
Forskellen i forhold til den eksisterende billedgenerering er tydelig: tidligere understøttede Gemini 2.5 Flash Image allerede prompt-baserede og billedbaserede transformationer . Denne opdatering bringer hele den skabelses- og redigeringsløkke ind i en samtale i realtid med stemme og kamera, så du ikke længere behøver at taste tingene ind manuelt
.
Den underliggende billedmodel hedder Gemini 2.5 Flash Image ("nano-banana"), og Google beskriver den som deres mest avancerede model til billedgenerering og -redigering . Modellen har flere markante styrker:
Prisen for udviklere er $30,00 per 1 million output-tokens, og hvert billede tæller for 1290 output-tokens . Modellen er tilgængelig via Gemini API og Google AI Studio for udviklere, og via Vertex AI for virksomheder
.
Google I/O 2026 bød på en lang række annonceringer, som bygger direkte videre på denne udvikling:
Gemini Omni er en ny model, der kan skabe output fra forskellige typer input – startende med video . Google beskriver den som en kombination af Gemini-intelligensen og deres generative mediemodeller, hvilket giver et nyt niveau af multimodalitet, verdensforståelse og redigering
.
Ifølge Gemini-appens release-notes gør Gemini Omni det at skabe og redigere video lige så nemt som at føre en samtale – "ligesom Nano Banana, bare for video" – og understøtter blandinger af tekst, fotos og video . Brugerne kan lave alt fra helt nye klip til at remixe deres kamerarulle eller bruge færdige skabeloner. Og ja, du kan endda indsætte dig selv i handlingen ved at oprette en AI-avatar, der ligner og lyder som dig
.
På sigt er ambitionen, at Gemini Omni skal kunne generere "hvad som helst fra hvad som helst" . Første offentlige version hedder Gemini Omni Flash, som ruller ud til Google AI Plus-, Pro- og Ultra-abonnenter via Gemini-appen, Google Flow og YouTube Shorts
.
Gemini 3.5 Flash er den nye standardmodel i Gemini-appen og i Google Searchs AI Mode . Google hævder, at den outputter tokens fire gange hurtigere end andre frontiermodeller i samme klasse og er designet til agent-opgaver, kodning, flertrins-arbejdsgange og langvarige opgaver
.
På benchmarks overgår Gemini 3.5 Flash den ældre Gemini 3.1 Pro på flere kodnings- og agent-tests, ligesom den slår konkurrenter som GPT-5.5 og Claude Opus 4.7 i opgaver med flertrins-værktøjsbrug, finansiel analyse og kompleks kodning .
Googles strategi er ifølge annonceringerne centreret omkring én samlet multimodal realtids-pipeline – altså en strømlinet oplevelse, hvor samtale, kamera-input, billedgenerering og videoproduktion smelter sammen .
Googles fordel – baseret på disse annonceringer – er integrationsdybden og hastigheden: Gemini Live lukker løkken mellem at "vis Gemini, hvad jeg ser" og "bed Gemini om at skabe eller redigere noget". Gemini Omni skubber den samme konverserende model videre mod video og bredere multimodal output, mens Gemini 3.5 Flash leverer den rå hastighed, der skal til for at få det hele til at føles øjeblikkeligt .
Det helt store spørgsmål, der står tilbage, er selvfølgelig, hvor godt disse integrerede workflows reelt fungerer i praksis, efterhånden som de rulles bredere ud . Men retningen er klar: Google satser på en fremtid, hvor kunstig intelligens ikke bare forstår, hvad du siger – men også hvad du ser, og kan omsætte det til nyt indhold i samme åndedrag.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Hvad Google har tilføjet: Gemini Live understøtter nu direkte realtidsgenerering og redigering af billeder via kamera deling og stemmekommandoer [8].
Hvad Google har tilføjet: Gemini Live understøtter nu direkte realtidsgenerering og redigering af billeder via kamera deling og stemmekommandoer [8]. Sådan virker det: Peg telefonen mod et motiv, aktiver kameradeling i en Live samtale, og giv instrukser på naturligt sprog for at generere eller redigere billeder direkte i appen [8].
Teknologien bag: Modellen hedder Gemini 2.5 Flash Image (kaldenavn "nano banana") og er Googles hidtil mest avancerede værktøj til billedgenerering og redigering [2].