Google meluncurkan fitur pembuatan dan pengeditan gambar secara langsung dan real time di dalam mode percakapan Gemini Live [8]. Saat sedang dalam percakapan suara Live, pengguna bisa mengaktifkan berbagi kamera, mengarahkan ponsel ke suatu objek, dan memberikan instruksi suara natural untuk membuat atau mengedit ga...

Create a landscape editorial hero image for this Studio Global article: What real-time image generation and editing capability has Google added to Gemini Live, how does it work on Android and iOS, what technology. Article summary: ## What Google Added to Gemini Live. Topic tags: general, documentation, general web, user generated, education. Reference image context from search candidates: Reference image 1: visual subject "Google has begun the deployment of Gemini's innovative real-time AI video functionalities, enabling the platform to interpret visual input from a user's device" source context "Google's Gemini update that can tell you live what it sees through your camera is now rolling out - PhoneArena" Reference image 2: visual subject "Smartphones must have user-replaceable batteries by 2027. But not your iPhone. Here's why" source context "Google's Gemini update that can tell you l
Google telah merilis kemampuan pembuatan dan pengeditan gambar secara langsung (real-time) di dalam Gemini Live, mode asisten AI percakapan miliknya . Saat kamu sedang dalam percakapan suara Live, kamu bisa mengaktifkan fitur berbagi kamera, mengarahkan ponsel ke suatu objek, dan memberikan instruksi dengan bahasa natural untuk membuat atau mengedit gambar saat itu juga
. Gambar yang dihasilkan atau diedit akan muncul langsung di dalam tampilan percakapan Live tanpa perlu berpindah aplikasi
.
Perbedaan utamanya: kalau sebelumnya pembuatan dan pengeditan gambar di Gemini lebih mengandalkan prompt teks atau unggahan gambar manual, kini Gemini Live membawa proses kreatif itu ke dalam percakapan suara dan kamera real-time .
Model penghasil gambar yang menjadi otak dari fitur ini adalah Gemini 2.5 Flash Image, yang dikenal juga dengan nama nano-banana. Google menyebutnya sebagai model pembuatan dan pengeditan gambar tercanggih mereka saat ini . Beberapa kemampuan utamanya:
Teknologi ini bisa diakses oleh pengembang melalui Gemini API dan Google AI Studio, serta oleh pelanggan enterprise lewat Vertex AI .
Di ajang Google I/O 2026, Google mengumumkan sejumlah pembaruan besar yang memperkuat momentum ini:
Gemini Omni — Model anyar yang bisa menciptakan konten dari berbagai jenis input, dimulai dari video . Google menyebut Omni menggabungkan kecerdasan Gemini dengan model media generatifnya untuk pemahaman dunia (world understanding), multimodalitas, dan editing yang lebih baik
. Dalam catatan rilis aplikasi Gemini, Omni digambarkan membuat pembuatan dan pengeditan video semudah ngobrol, “seperti Nano Banana untuk video,” dan mendukung penggabungan teks, foto, dan video
. Ke depannya, Omni dirancang untuk bisa menghasilkan “apa saja dari input apa saja”
.
Gemini 3.5 Flash — Model default baru untuk aplikasi Gemini dan mode AI di Google Search . Google mengklaim model ini menghasilkan token empat kali lebih cepat dibanding model frontier lain di kelasnya, dan dirancang khusus untuk tugas-tugas agentik, coding, alur kerja multi-langkah, dan tugas jangka panjang
.
Pengumuman lain yang menonjol:
Posisi Google saat ini bertumpu pada saluran multimodal real-time terpadu yang mencakup percakapan, input kamera, pembuatan gambar, dan pembuatan video .
Keunggulan Google, berdasarkan pengumuman ini, terletak pada kedalaman integrasi: Gemini Live menutup celah antara “tunjukkan apa yang aku lihat” dan “minta Gemini untuk membuat atau mengedit sesuatu,” sementara Gemini Omni mendorong model percakapan yang sama ke arah video dan output multimodal yang lebih luas . Yang masih jadi pertanyaan kunci: seberapa baik alur kerja terintegrasi ini bekerja dalam praktik seiring peluncurannya yang semakin luas
.
Artikel ini didasarkan pada informasi yang tersedia dari pengumuman resmi Google, blog pengembang, dan liputan Google I/O 2026 hingga 7 Juni 2026. Beberapa fitur mungkin masih dalam tahap peluncuran bertahap dan mungkin belum tersedia di semua wilayah atau jenis akun.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Google meluncurkan fitur pembuatan dan pengeditan gambar secara langsung dan real time di dalam mode percakapan Gemini Live [8].
Google meluncurkan fitur pembuatan dan pengeditan gambar secara langsung dan real time di dalam mode percakapan Gemini Live [8]. Saat sedang dalam percakapan suara Live, pengguna bisa mengaktifkan berbagi kamera, mengarahkan ponsel ke suatu objek, dan memberikan instruksi suara natural untuk membuat atau mengedit gambar [8].
Hasil gambar akan langsung muncul dan bisa diedit lebih lanjut tanpa meninggalkan tampilan percakapan Live [8].