ข้อความที่ถอดเสียงจะถูกใส่ลงตรงตำแหน่งเคอร์เซอร์ในแอปที่กำลังเปิดอยู่ นอกจากการพิมพ์ตามคำบอกแล้ว ผู้ใช้ยังสามารถเลือกข้อความเพื่อให้ Gemini ปรับแก้หรือแปลงเนื้อหา รวมถึงสั่งสร้างภาพจากตำแหน่งเดิมได้
หากเปิดโหมดการให้เหตุผล Gemini ยังสามารถทำงานหลายขั้นตอนผ่านคำสั่งเสียงได้ด้วย อย่างไรก็ตาม ฟีเจอร์ Intelligent Dictation ในช่วงเริ่มต้นรองรับภาษาอังกฤษก่อน และ Google ระบุว่าจะเพิ่มภาษาอื่นในภายหลัง
การอัปเดตนี้ต่อยอดจากแอป Gemini แบบเนทีฟบน macOS ที่เปิดตัวครั้งแรกในงาน Google I/O 2026 ซึ่งเดิมมีแถบแชตเรียกด้วยปุ่ม Option + Space และความสามารถแชร์หน้าจอ
เมื่อวันที่ 21 กรกฎาคม 2026 Google เปิดตัวโมเดล Gemini ใหม่ 3 รุ่น ได้แก่ Gemini 3.6 Flash, Gemini 3.5 Flash-Lite และ Gemini 3.5 Flash Cyber ซึ่งเป็นโมเดลด้านความปลอดภัยที่มีการจำกัดการเข้าถึง ที่น่าสนใจคือการเปิดตัวครั้งนี้ยังไม่มี Gemini 3.5 Pro รุ่นเรือธงที่หลายคนรอคอย
Gemini 3.6 Flash ถูกวางตำแหน่งเป็นโมเดลใช้งานทั่วไปที่สมดุลระหว่างความสามารถกับต้นทุน โดย Google ระบุว่าปรับปรุงประสิทธิภาพด้านการเขียนโค้ด งานความรู้ และการทำงานกับข้อมูลหลายรูปแบบ พร้อมใช้โทเคนน้อยกว่า Gemini 3.5 Flash สูงสุด 17%
ราคาสำหรับ Gemini API อยู่ที่ 1.50 ดอลลาร์ต่อโทเคนอินพุต 1 ล้านรายการ และ 7.50 ดอลลาร์ต่อโทเคนเอาต์พุต 1 ล้านรายการ ลดลงจากราคาเอาต์พุตเดิมที่ 9 ดอลลาร์ โมเดลนี้มีหน้าต่างบริบทขนาด 1 ล้านโทเคน และมีข้อมูลความรู้ตัด ณ เดือนมีนาคม 2026
Gemini 3.6 Flash เปิดให้ใช้งานผ่าน Gemini API, Google AI Studio, Android Studio, Gemini app, Google Antigravity และ Gemini Enterprise app ผู้ใช้ทั่วไปยังสามารถเข้าถึงโมเดลนี้ได้ฟรีภายใน Gemini app
Gemini 3.5 Flash-Lite เน้นงานที่ต้องการความเร็วสูงและประมวลผลจำนวนมาก เช่น การค้นหาแบบเอเจนต์และการจัดการเอกสาร Google ระบุว่าเป็นโมเดลตระกูล 3.5 ที่เร็วและคุ้มค่าที่สุด โดยทำความเร็วเอาต์พุตได้ 350 โทเคนต่อวินาที
ราคาสำหรับ API อยู่ที่ 0.30 ดอลลาร์ต่อโทเคนอินพุต 1 ล้านรายการ และ 2.50 ดอลลาร์ต่อโทเคนเอาต์พุต 1 ล้านรายการ โมเดลนี้มีหน้าต่างบริบท 1 ล้านโทเคนเช่นกัน และกำลังทยอยนำไปใช้กับ Google Search นอกเหนือจาก Gemini API และ Gemini app
ทั้ง Gemini 3.6 Flash และ Gemini 3.5 Flash-Lite เปิดให้ใช้งานทันที และเข้าถึงได้ฟรีผ่าน Gemini app
Gemini Spark คือผู้ช่วย AI ส่วนบุคคลที่ทำงานได้ตลอด 24 ชั่วโมง ซึ่ง Google เคยเปิดตัวตัวอย่างแรกในงาน I/O 2026 โดยกำลังทยอยเปิดให้สมาชิกแบบชำระเงินในหลายพื้นที่ทั่วโลก
Spark ทำงานบนคลาวด์และสามารถดำเนินงานต่อได้แม้ผู้ใช้ปิดแล็ปท็อปหรือล็อกโทรศัพท์แล้ว การอัปเดตครั้งนี้เพิ่มความสามารถสำคัญหลายด้าน ได้แก่
ด้านการให้บริการ Spark กำลังทยอยเปิดแก่สมาชิก Google AI Pro ราคา 20 ดอลลาร์ต่อเดือนในสหรัฐฯ และสมาชิก Google AI Ultra ราคา 100–200 ดอลลาร์ต่อเดือน ในประเทศที่รองรับ ผู้ใช้ฟรียังไม่สามารถใช้งานได้ พื้นที่ที่มีข้อยกเว้นตามข้อมูลการเปิดตัว ได้แก่ เขตเศรษฐกิจยุโรป สวิตเซอร์แลนด์ สหราชอาณาจักร และไนจีเรีย
ระบบ Connected Apps ของ Gemini Spark รองรับแอปภายนอกเพิ่ม ได้แก่ Canva, Instacart และ OpenTable นอกจากนี้ยังเชื่อมต่อกับ Google Keep และ Google Tasks เพื่ออ่านและเขียนข้อมูลในโน้ตหรือรายการงานได้
Google ยังรองรับการเชื่อมต่อแอปแบบกำหนดเองผ่าน Model Context Protocol หรือ MCP ซึ่งช่วยให้ผู้ใช้เชื่อมต่อแอปส่วนตัวหรือบริการอื่นที่มีเซิร์ฟเวอร์ MCP ได้
นอกเหนือจาก Spark แล้ว Gemini app โดยรวมก็ขยายระบบเชื่อมต่อกับแอปของ Google และบริการภายนอกเพิ่มเติม ตามแนวทางที่ Google เริ่มวางไว้ก่อนหน้านี้ในปี 2026
Google เพิ่มฟีเจอร์อวตารที่ช่วยให้ผู้ใช้ ใส่ตัวเองลงในภาพใดก็ได้ โดยบันทึกอวตารส่วนตัวไว้ก่อน จากนั้นระบบจะสร้างเนื้อหาที่มีรูปลักษณ์สอดคล้องกับผู้ใช้ โดยไม่ต้องอัปโหลดภาพใหม่ทุกครั้ง
แนวทางนี้ช่วยลดขั้นตอนการใส่ภาพอ้างอิงซ้ำ ๆ และทำให้การสร้างภาพที่มีตัวผู้ใช้เป็นองค์ประกอบทำได้สะดวกขึ้น ทั้งนี้ ผลลัพธ์ยังขึ้นอยู่กับอวตารที่บันทึกไว้และคำสั่งที่ผู้ใช้ระบุ
ฟีเจอร์สร้างภาพเฉพาะบุคคลของ Gemini ซึ่งผสานโมเดลสร้างภาพ Nano Banana เข้ากับระบบ Personal Intelligence เปิดให้ผู้ใช้ที่มีสิทธิ์ในสหรัฐฯ ใช้งานฟรีแล้ว
ก่อนหน้านี้ฟีเจอร์ดังกล่าวจำกัดอยู่ในแพ็กเกจ Google AI Plus, Pro และ Ultra แต่ตอนนี้ผู้ใช้ในสหรัฐฯ ที่มีอายุ 18 ปีขึ้นไปและลงชื่อเข้าใช้ด้วยบัญชี Google ที่เข้าเกณฑ์สามารถใช้งานได้โดยไม่ต้องสมัครแพ็กเกจแบบชำระเงิน
ระบบสามารถใช้บริบทจากแอป Google ที่ผู้ใช้เชื่อมต่อไว้ เช่น Gmail, Google Photos, YouTube และ Search เพื่อสร้างภาพที่สอดคล้องกับความสนใจ ไลฟ์สไตล์ และความทรงจำส่วนตัว ผู้ใช้อาจพิมพ์คำสั่งสั้น ๆ อย่าง “ออกแบบบ้านในฝันของฉัน” หรือ “สร้างภาพประกอบของฉันกับสัตว์เลี้ยงตัวโปรด” โดยไม่จำเป็นต้องอธิบายรายละเอียดชีวิตของตัวเองเป็นข้อความยาว ๆ
อย่างไรก็ตาม การเปิดให้ใช้งานฟรีในประกาศนี้ระบุเฉพาะผู้ใช้ที่มีสิทธิ์ในสหรัฐฯ จึงยังไม่ควรตีความว่าเปิดให้ผู้ใช้ทุกประเทศใช้งานได้แล้ว
Gemini Drop เดือนกรกฎาคม 2026 ไม่ได้มีเพียงการเพิ่มความสามารถตอบคำถามหรือปรับปรุงโมเดล แต่ยังเน้นการทำให้ Gemini เข้าไปอยู่ในขั้นตอนการทำงานจริงมากขึ้น ตั้งแต่พิมพ์ข้อความด้วยเสียงในแอปใดก็ได้บน Mac ให้ Spark แก้ไขไฟล์ Workspace และจัดการงานบนเว็บ ไปจนถึงการสร้างภาพที่อ้างอิงข้อมูลส่วนตัวของผู้ใช้
จุดเปลี่ยนสำคัญคือ Google กำลังผลักดันให้ Gemini ทำงาน “แทนผู้ใช้” ในบางขั้นตอน ไม่ใช่เพียงแนะนำว่าควรทำอะไร แต่สามารถเข้าไปดำเนินการต่อภายใต้การอนุญาตของผู้ใช้ได้ ขณะเดียวกัน ขอบเขตการให้บริการ ภาษา ราคาสมาชิก และสิทธิ์ในการเชื่อมต่อข้อมูลยังเป็นปัจจัยที่ผู้ใช้ควรตรวจสอบก่อนเริ่มใช้งานจริง