最受关注的新功能之一是 Docs Live。它允许用户通过语音直接创建和编辑Google Docs文档。
在演示中,用户只需描述需求,例如:
Gemini会根据这些口头说明自动生成结构化文档草稿。如果用户允许访问相关数据,它还能从 Gmail、Drive、Google Chat 或网络资料中提取相关信息补充内容 。
这种方式更像是 与AI编辑协作写作,而不是逐句语音输入文字。
Google Keep 也加入了类似的语音AI能力,主要用于快速记录想法。
用户只需开始说话——哪怕是随意的“脑内倾倒”(brain dump)——Gemini也能把语音内容整理成清晰的笔记。系统可以:
这样即使只是随口记录想法,也能自动得到可用的结构化内容,无需后期整理 。
在 Gmail 中,Gemini语音功能更像是一个“邮件助理”。
用户可以直接问:
Gemini会扫描相关邮件并给出答案,相当于把收件箱变成一个可以 用语音查询的知识库 。
Google认为,语音输入在AI时代有明显优势。
当用户打字时,往往会把指令写得很短,甚至分成多条提示逐步补充。但在说话时,人们通常会 自然地表达更长、更完整的需求,这反而更容易被AI理解 。
同时,最新的语音和语言模型还能:
例如用户在描述文档需求时临时改变语气或增加条件,Gemini也可以根据最终表达的意图正确执行 。
Google表示,这些Workspace语音功能将 从2026年夏季开始逐步推出。首批可用人群包括:
初期版本预计在 Android 和 iOS 上以英语推出,之后可能扩展到更多语言和地区 。
这些更新展示了办公软件的一种新趋势:用户不再需要在不同应用之间来回切换,也不必手动整理信息。
相反,一个AI层可以跨越文档、邮件和笔记,根据用户的语音指令完成任务。
如果Google的设想成为现实,未来的日常工作可能会越来越像 “和软件聊天”——而不是操作软件。