Fungsinya bukan sekadar transkripsi. Pengguna juga boleh memilih teks untuk diubah suai atau meminta Gemini menghasilkan visual terus dalam aplikasi yang sedang dibuka . Jika mod penaakulan diaktifkan, Gemini boleh melaksanakan tugasan berbilang langkah menggunakan arahan suara .
Buat masa ini, ciri tersebut hanya tersedia dalam bahasa Inggeris, manakala sokongan bahasa tambahan akan menyusul . Ia menambah baik aplikasi Gemini asli untuk macOS yang diperkenalkan di Google I/O 2026, yang sebelum ini menawarkan bar sembang melalui pintasan Option + Space serta keupayaan berkongsi skrin .
Pada 21 Julai 2026, Google melancarkan tiga model Gemini baharu: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite dan Gemini 3.5 Flash Cyber, iaitu model keselamatan dengan akses terhad . Namun, model yang dinanti-nantikan, Gemini 3.5 Pro, masih belum dikeluarkan .
Gemini 3.6 Flash ialah model serba guna baharu Google untuk pengekodan, kerja pengetahuan dan tugasan multimodal. Google mendakwa model ini boleh memberikan prestasi lebih baik sambil menggunakan sehingga 17 peratus token lebih sedikit berbanding Gemini 3.5 Flash .
Harga API ditetapkan pada AS$1.50 bagi setiap sejuta token input dan AS$7.50 bagi setiap sejuta token output, turun daripada AS$9.00 untuk token output pada generasi sebelumnya . Model ini mempunyai tetingkap konteks sejuta token serta tarikh pengetahuan sehingga Mac 2026 .
Ia tersedia melalui Gemini API, Google AI Studio, Android Studio, aplikasi Gemini, Google Antigravity dan aplikasi Gemini Enterprise .
Gemini 3.5 Flash-Lite pula menyasarkan tugasan berjumlah besar dan memerlukan latensi rendah, seperti carian berasaskan ejen serta pemprosesan dokumen . Google menyifatkannya sebagai model paling pantas dan paling menjimatkan kos dalam keluarga Gemini 3.5, dengan kelajuan sehingga 350 token output sesaat .
Harganya ialah AS$0.30 bagi setiap sejuta token input dan AS$2.50 bagi setiap sejuta token output . Ia turut mempunyai tetingkap konteks sejuta token dan sedang diperkenalkan ke Google Search, selain Gemini API dan aplikasi Gemini .
Kedua-dua model tersedia serta-merta dan boleh digunakan secara percuma dalam aplikasi Gemini .
Gemini Spark, pembantu AI peribadi yang boleh bekerja 24 jam sehari, mula diperkenalkan sebagai versi pratonton di Google I/O 2026 dan kini diperluas kepada lebih ramai pelanggan di seluruh dunia . Oleh sebab Spark beroperasi melalui awan, tugasan boleh terus berjalan walaupun pengguna menutup komputer riba atau mengunci telefon .
Antara peningkatan utama ialah:
Dari segi akses, Spark dilancarkan kepada pelanggan Google AI Pro berharga AS$20 sebulan di Amerika Syarikat, serta pelanggan Google AI Ultra berharga AS$100 hingga AS$200 sebulan di negara yang disokong . Pengguna percuma masih tidak mendapat akses . Pengecualian geografi termasuk Kawasan Ekonomi Eropah, Switzerland, United Kingdom dan Nigeria .
Selain ciri khusus Spark, Google turut memperluas ekosistem aplikasi yang boleh disambungkan kepada aplikasi Gemini secara keseluruhan. Pengguna kini boleh menghubungkan Gemini kepada lebih banyak aplikasi Google dan pihak ketiga, meneruskan rangka kerja integrasi yang diperkenalkan lebih awal pada 2026 .
Dalam Spark, sokongan untuk Canva, Instacart, OpenTable, Google Keep dan Google Tasks menjadikan Gemini lebih berguna untuk tugasan harian seperti mengurus senarai, merancang aktiviti atau berinteraksi dengan perkhidmatan lain .
Kemas kini avatar membolehkan pengguna menyimpan avatar peribadi dan kemudian memasukkan diri sendiri ke dalam mana-mana imej tanpa perlu memuat naik foto baharu setiap kali . Sistem akan menghasilkan kandungan visual yang memasukkan rupa pengguna berdasarkan avatar yang telah disimpan .
Ciri penjanaan imej diperibadikan Gemini yang menggabungkan model imej Nano Banana dengan keupayaan Personal Intelligence kini tersedia secara percuma kepada semua pengguna layak di Amerika Syarikat yang berumur 18 tahun ke atas dan log masuk menggunakan akaun Google . Sebelum ini, ciri tersebut hanya tersedia untuk pelanggan Google AI Plus, Pro dan Ultra.
Dengan kebenaran pengguna, Gemini boleh menggunakan konteks daripada aplikasi Google yang disambungkan seperti Gmail, Google Photos, YouTube dan Search untuk menghasilkan imej yang disesuaikan dengan minat, gaya hidup serta memori peribadi .
Ini bermakna pengguna boleh memberikan arahan ringkas seperti “reka rumah impian saya” atau “hasilkan ilustrasi saya bersama haiwan peliharaan kegemaran” tanpa perlu menulis penerangan yang panjang dan terperinci . Namun, peluasan percuma ini hanya disahkan untuk pengguna layak di Amerika Syarikat, bukan akses global.
Secara keseluruhan, Gemini Drop Julai 2026 menggabungkan tiga hala tuju utama Google: menjadikan interaksi AI lebih semula jadi melalui suara, mengurangkan kos penggunaan model dan mengubah Gemini menjadi ejen yang boleh bertindak dalam aplikasi lain. Spark ialah contoh paling jelas perubahan ini kerana ia bukan sekadar memberikan jawapan, malah boleh meneruskan tugasan di latar belakang dengan akses yang diberikan pengguna.
Pada masa sama, had langganan, ketersediaan mengikut negara dan sokongan bahasa masih menjadi faktor penting. Jadi, walaupun enam kemas kini ini memperluas keupayaan Gemini dengan ketara, tidak semua ciri tersedia kepada pengguna percuma atau di setiap pasaran.