यह सुविधा सिर्फ dictation तक सीमित नहीं है। यूज़र किसी टेक्स्ट को highlight करके उसे बदलने, संक्षेप में लिखने या उसी जगह visual बनाने के लिए भी आवाज़ का इस्तेमाल कर सकते हैं । Reasoning mode चालू होने पर Gemini आवाज़ के निर्देशों से जटिल, कई चरणों वाले काम भी कर सकता है ।
फिलहाल Intelligent Dictation अंग्रेज़ी में उपलब्ध है; Google ने आगे और भाषाओं का समर्थन देने की बात कही है । यह अपडेट उस native Gemini macOS app पर आधारित है, जिसे Google ने I/O 2026 में Option + Space शॉर्टकट और screen-sharing जैसे फीचर्स के साथ पेश किया था ।
21 जुलाई 2026 को Google ने तीन Gemini मॉडल जारी किए—Gemini 3.6 Flash, Gemini 3.5 Flash-Lite और सीमित पहुंच वाला सुरक्षा-केंद्रित Gemini 3.5 Flash Cyber । इस रिलीज़ में लंबे समय से प्रतीक्षित Gemini 3.5 Pro शामिल नहीं था और वह अब भी जारी नहीं हुआ है ।
इसे Google ने सामान्य कामकाज के लिए अपना नया workhorse मॉडल बनाया है। कंपनी के अनुसार इसमें coding, multimodal काम और knowledge work में सुधार हुआ है, जबकि यह पिछले Gemini 3.5 Flash की तुलना में 17% तक कम tokens इस्तेमाल करता है ।
API की कीमत 10 लाख input tokens के लिए 1.50 डॉलर और 10 लाख output tokens के लिए 7.50 डॉलर है। पिछली पीढ़ी में output tokens की कीमत 9 डॉलर थी । मॉडल में 1 मिलियन tokens की context window और मार्च 2026 तक का knowledge cutoff है ।
यह Gemini API, Google AI Studio, Android Studio, Gemini app, Google Antigravity और Gemini Enterprise app में उपलब्ध है ।
Flash-Lite को high-throughput और low-latency कामों के लिए तैयार किया गया है—जैसे agentic search, document processing और बड़े AI-agent सिस्टम के छोटे-छोटे tasks । Google के मुताबिक यह 3.5 परिवार का सबसे तेज़ और कम लागत वाला मॉडल है, जिसकी output speed 350 tokens प्रति सेकंड है ।
इसकी API कीमत 10 लाख input tokens के लिए 0.30 डॉलर और 10 लाख output tokens के लिए 2.50 डॉलर है । इसमें भी 1 मिलियन tokens की context window है। इसे Gemini API और Gemini app के साथ Google Search में भी शामिल किया जा रहा है ।
दोनों मॉडल Gemini app में यूज़र्स के लिए मुफ्त उपलब्ध हैं ।
Google का 24/7 personal AI agent Gemini Spark, जिसे पहली बार I/O 2026 में preview किया गया था, अब subscribers के लिए अधिक देशों में पहुंच रहा है । यह cloud पर काम करता है, इसलिए laptop बंद करने या फोन लॉक करने के बाद भी सौंपे गए tasks चलते रह सकते हैं ।
इस Drop में Spark को Google Workspace और वेब पर कई अहम क्षमताएं मिली हैं:
जुलाई Drop में Spark के अलावा Gemini app का connected ecosystem भी बढ़ाया गया है । Spark के लिए Canva, Instacart और OpenTable Connected Apps के रूप में जोड़े जा रहे हैं ।
इसके अलावा Spark अब Google Keep और Google Tasks में मौजूद सामग्री को पढ़ और उसमें लिख सकता है । डेवलपर और उन्नत यूज़र्स Model Context Protocol (MCP) server URLs के जरिये custom app connections भी बना सकते हैं ।
Gemini का नया avatar फीचर यूज़र्स को अपना personal avatar सहेजने देता है। इसके बाद किसी नई इमेज में खुद को शामिल करने के लिए हर बार फोटो अपलोड करने की जरूरत नहीं होगी । सिस्टम saved avatar के आधार पर ऐसा content तैयार करता है, जिसमें यूज़र का रूप दिखाई देता है ।
यह फीचर उन लोगों के लिए उपयोगी हो सकता है जो अलग-अलग creative scenes, visual stories या personal concepts में अपना digital version देखना चाहते हैं।
Gemini की Personal Intelligence और Nano Banana image model पर आधारित personalized image generation सुविधा अब अमेरिका के सभी योग्य यूज़र्स के लिए मुफ्त उपलब्ध है। इसके लिए यूज़र की उम्र कम से कम 18 वर्ष होनी चाहिए और उन्हें personal Google account से sign in करना होगा ।
पहले यह सुविधा Google AI Plus, Pro और Ultra subscribers तक सीमित थी। अब Gemini, यूज़र की अनुमति से जुड़े Google apps—जैसे Gmail, Google Photos, YouTube और Search—से मिले context का इस्तेमाल कर सकता है। इससे बनाई गई images यूज़र की पसंद, lifestyle और personal memories के अनुरूप हो सकती हैं ।
उदाहरण के लिए, यूज़र केवल “मेरे सपनों का घर डिजाइन करो” या “मुझे और मेरे पसंदीदा पालतू जानवर को साथ दिखाने वाली illustration बनाओ” जैसा छोटा prompt दे सकता है। हर छोटी-बड़ी personal detail को लंबा लिखने की जरूरत नहीं होगी ।
हालांकि, इस मुफ्त विस्तार की घोषणा योग्य अमेरिका-स्थित यूज़र्स के लिए की गई है। इसे भारत या अन्य देशों में उपलब्ध मानने से पहले स्थानीय rollout और eligibility की जानकारी देखना जरूरी होगा।
जुलाई 2026 का Drop दिखाता है कि Google Gemini को केवल सवालों के जवाब देने वाले chatbot के रूप में नहीं, बल्कि काम करने वाले assistant के रूप में आगे बढ़ा रहा है। Mac पर यह किसी भी ऐप के भीतर आवाज़ से काम कर सकता है, Flash मॉडल developers को तेज़ और कम लागत वाले विकल्प देते हैं, जबकि Spark Workspace और Chrome के जरिये background में tasks संभालने की दिशा में बढ़ रहा है ।
साथ ही, avatar और personalized image tools Gemini को अधिक व्यक्तिगत creative platform बनाने की कोशिश हैं। लेकिन Spark की subscription और geographic सीमाएं तथा personalized images की US-only eligibility बताती है कि इन सभी सुविधाओं की पहुंच अभी हर यूज़र के लिए समान नहीं है ।