Gemini Live integra ora la generazione e modifica di immagini in tempo reale: basta attivare la condivisione della fotocamera e parlare con l'IA [8]. La tecnologia si basa sul modello Gemini 2.5 Flash Image, soprannominato "nano banana", che supporta fusione di immagini, coerenza dei personaggi e modifiche mirate tr...

Create a landscape editorial hero image for this Studio Global article: What real-time image generation and editing capability has Google added to Gemini Live, how does it work on Android and iOS, what technology. Article summary: ## What Google Added to Gemini Live. Topic tags: general, documentation, general web, user generated, education. Reference image context from search candidates: Reference image 1: visual subject "Google has begun the deployment of Gemini's innovative real-time AI video functionalities, enabling the platform to interpret visual input from a user's device" source context "Google's Gemini update that can tell you live what it sees through your camera is now rolling out - PhoneArena" Reference image 2: visual subject "Smartphones must have user-replaceable batteries by 2027. But not your iPhone. Here's why" source context "Google's Gemini update that can tell you l
Google ha introdotto la generazione e modifica di immagini in tempo reale direttamente all'interno di Gemini Live, la sua modalità di intelligenza artificiale conversazionale . Durante una conversazione vocale, puoi attivare la condivisione della fotocamera, inquadrare un soggetto e dare istruzioni in linguaggio naturale per creare o modificare immagini al volo
. Il risultato viene generato o modificato direttamente nell'esperienza Live
.
La differenza fondamentale: le esistenti capacità di generazione e modifica immagini tramite Gemini 2.5 Flash Image supportano trasformazioni basate su prompt e immagini, mentre la nuova integrazione in Gemini Live porta quel ciclo di creazione/modifica in una conversazione vocale con supporto visivo in tempo reale .
Il modello di immagini sottostante è Gemini 2.5 Flash Image, soprannominato nano-banana, che Google descrive come il suo modello di generazione e modifica immagini più avanzato . Le capacità principali includono:
Diverse importanti presentazioni al Google I/O 2026 costruiscono direttamente su questo slancio:
Gemini Omni — Un nuovo modello che può creare output a partire da diversi tipi di input, a cominciare dai video . Google afferma che combina l'intelligenza di Gemini con i suoi modelli generativi multimediali per un miglioramento della multimodalità, della comprensione del mondo e del montaggio
. Le note di rilascio dell'app Gemini descrivono Omni come uno strumento per rendere la creazione e la modifica video simili a una conversazione, "come Nano Banana per i video", con supporto per la combinazione di testo, foto e video
. Nel tempo, Google prevede che Omni sia in grado di creare "qualsiasi cosa da qualsiasi input"
.
Gemini 3.5 Flash — Il nuovo modello predefinito per l'app Gemini e la "Modalità AI" di Google Search . Google dichiara che genera token quattro volte più velocemente di altri modelli di frontiera nella sua categoria ed è progettato per compiti agentici, codice, flussi di lavoro in più fasi e attività a lungo termine
.
Altri annunci degni di nota:
Il posizionamento di Google è incentrato su una pipeline multimodale unificata in tempo reale attraverso conversazione, input della fotocamera, generazione di immagini e creazione video .
Il vantaggio di Google, sulla base di questi annunci, è la profondità di integrazione: Gemini Live chiude il cerchio tra "mostra a Gemini ciò che vedo" e "chiedi a Gemini di creare o modificare qualcosa", mentre Gemini Omni spinge lo stesso modello conversazionale verso il video e output multimodali più ampi . La domanda chiave che rimane è quanto bene questi flussi di lavoro integrati funzioneranno nella pratica man mano che saranno distribuiti più ampiamente
.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Gemini Live integra ora la generazione e modifica di immagini in tempo reale: basta attivare la condivisione della fotocamera e parlare con l'IA [8].
Gemini Live integra ora la generazione e modifica di immagini in tempo reale: basta attivare la condivisione della fotocamera e parlare con l'IA [8]. La tecnologia si basa sul modello Gemini 2.5 Flash Image, soprannominato "nano banana", che supporta fusione di immagini, coerenza dei personaggi e modifiche mirate tramite linguaggio naturale [2].
Su Android e iOS, l'esperienza è fluida: inquadra un soggetto e chiedi a Gemini Live di creare o trasformare un'immagine con la voce, senza strumenti di editing complessi [8].