Google telah menambah keupayaan penjanaan dan suntingan imej masa nyata secara langsung dalam Gemini Live, mod perbualan AI nya [8]. Semasa perbualan suara Live, pengguna boleh mengaktifkan perkongsian kamera, menghalakannya ke subjek, dan memberi arahan bahasa semula jadi untuk menjana atau menyunting imej [8].

Create a landscape editorial hero image for this Studio Global article: What real-time image generation and editing capability has Google added to Gemini Live, how does it work on Android and iOS, what technology. Article summary: ## What Google Added to Gemini Live. Topic tags: general, documentation, general web, user generated, education. Reference image context from search candidates: Reference image 1: visual subject "Google has begun the deployment of Gemini's innovative real-time AI video functionalities, enabling the platform to interpret visual input from a user's device" source context "Google's Gemini update that can tell you live what it sees through your camera is now rolling out - PhoneArena" Reference image 2: visual subject "Smartphones must have user-replaceable batteries by 2027. But not your iPhone. Here's why" source context "Google's Gemini update that can tell you l
Google kini menyediakan penjanaan dan suntingan imej masa nyata secara langsung di dalam Gemini Live, mod perbualan AI mayanya . Tidak seperti sebelum ini, anda tidak perlu lagi menaip arahan yang rumit. Sebaliknya, semasa sesi perbualan suara Live, anda boleh mengaktifkan perkongsian kamera, menghalakan telefon ke subjek, dan memberi arahan dalam bahasa biasa untuk menjana atau menyunting imej terus di skrin
. Hasilnya muncul serta-merta dalam pengalaman perbualan Live itu sendiri
.
Aliran kerja untuk kedua-dua platform adalah sangat serupa dan intuitif, menjadikan penciptaan imej semudah berbual.
Perbezaan utama di sini adalah integrasi. Sebelum ini, penjanaan imej dengan model 2.5 Flash Image adalah berasaskan gesaan teks dan muat naik imej. Kini, ciri baharu Gemini Live membawa gelung penciptaan/suntingan itu ke dalam perbualan suara dan video masa nyata yang lancar .
Kuasa di sebalik ciri ini ialah model imej tercanggih Google, Gemini 2.5 Flash Image (nano-banana) . Ia bukan sekadar penjana imej biasa. Antara keupayaan utamanya termasuk:
Pengumuman di Google I/O 2026 membina momentum ini dengan pelbagai kemas kini utama yang lain, mengukuhkan ekosistem AI Google:
Gemini Omni — "Nano-Banana untuk Video"
Ini adalah model baharu yang boleh mencipta output daripada pelbagai jenis input, bermula dengan video . Google secara rasmi menyatakan Omni boleh "mencipta apa sahaja daripada sebarang input" pada masa hadapan. Buat masa ini, ia digelar "Nano Banana untuk video", membolehkan penciptaan dan suntingan video melalui perbualan
. Anda boleh menggabungkan teks, foto dan klip video, malah menyuntingnya dengan arahan suara seperti "tukar arca logam itu kepada buih sabun"
. Model ini menggantikan Veo dalam aplikasi Gemini
.
Gemini 3.5 Flash — Lebih Laju, Lebih Pintar
Ini adalah model lalai baharu untuk aplikasi Gemini dan Mod AI Carian Google . Google mendakwa ia mengeluarkan token empat kali lebih pantas daripada model setara yang bersaing, dan dibina khas untuk tugas-tugas ejen ("agen AI"), pengekodan, aliran kerja berbilang langkah, dan tugas jangka panjang yang kompleks
.
Lagi Kemas Kini Penting:
Dengan pengumuman ini, Google memposisikan dirinya di persimpangan antara perbualan masa nyata, input kamera, penjanaan media, dan penyuntingan pintar. Strateginya adalah integrasi yang mendalam di seluruh ekosistem.
Kelebihan Google, berdasarkan pengumuman ini, terletak pada kedalaman integrasinya. Ia bukan sekadar alat AI yang berasingan; ia adalah saluran paip multimodal bersatu yang dibina ke dalam aplikasi dan perkhidmatan yang sudah digunakan oleh berbilion pengguna. Persoalan utama yang tinggal ialah sejauh mana aliran kerja bersepadu ini berfungsi dalam amalan apabila ia dilancarkan dengan lebih meluas .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Google telah menambah keupayaan penjanaan dan suntingan imej masa nyata secara langsung dalam Gemini Live, mod perbualan AI nya [8].
Google telah menambah keupayaan penjanaan dan suntingan imej masa nyata secara langsung dalam Gemini Live, mod perbualan AI nya [8]. Semasa perbualan suara Live, pengguna boleh mengaktifkan perkongsian kamera, menghalakannya ke subjek, dan memberi arahan bahasa semula jadi untuk menjana atau menyunting imej [8].
Ciri ini dikuasakan oleh model imej terkini Google, Gemini 2.5 Flash Image (juga dikenali sebagai 'nano banana') [2].