Google 于 2026 年 8 月 11 日宣布,Gemini 应用月活跃用户已超过 10 亿,成为公司增长最快的产品;但新应用连接的可用性仍取决于地区、账号和设备。 Gemini Omni 是 Google DeepMind 推出的“任意输入到任意输出”多模态模型,当前的 Gemini Omni Flash 可根据文字生成 3 至 10 秒、720p 视频,并支持通过对话反复编辑。
研究答案

Create a landscape editorial hero image for this Studio Global article: What are the key recent developments and milestones for Google's Gemini AI assistant, including details about the Gemini Omni multimodal mod. Article summary: Here is a breakdown of the three major recent developments for Google's Gemini AI assistant.. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual ev
Google Gemini 正进入一个新的发展阶段:一边扩大用户规模,另一边扩展 AI 能力和应用边界。近期最值得关注的三项进展分别是:Gemini Omni 开始探索统一的多模态视频创作,Gemini 应用月活跃用户突破 10 亿,以及 Google 持续增加可在 Gemini 对话中调用的第三方服务。
Google 在 2026 年 5 月 19 日举行的 Google I/O 大会上发布 Gemini Omni,并将其描述为一种能够“从任何输入创建任何内容”的模型,首阶段从视频生成开始。用户可以同时提供文字、图片、音频和视频作为参考,模型则利用对现实世界的理解,生成具有整体一致性的视频。Google 表示,未来 Omni 还将支持图像和音频等更多输出形式。
这项技术的重点并不只是又一个“文字生成视频”工具,而是用户可以用更接近创作过程的方式来指导模型。例如,创作者可以同时提供剧本、静态图片、视频片段或声音参考,然后通过自然语言继续修改结果,而不必每次都从头提交全新的提示词。Google 将这种能力与更强的世界理解、多模态处理和编辑控制联系在一起。
面向开发者的首个版本 Gemini Omni Flash 于 2026 年 6 月 30 日进入公开预览。Google 发布说明显示,它可以根据文字描述生成 3 至 10 秒、720p 分辨率的视频,也能让静态图片动起来,并通过 Interactions API 支持持续编辑。
它的实际工作方式更像一场对话:先生成一段视频,再说明需要怎样修改,随后继续调整,而不是每次修改都重新开始。Google 的开发者文档将原生多模态处理和对话式编辑列为该模型的核心能力。
不过,Omni 目前仍有明确边界。它现阶段首先提供视频输出,还没有实现“所有输入对应所有输出”的完整愿景;Google 也表示,更多音频能力将逐步推出。模型输出默认启用 SynthID 水印,而语音编辑功能最初则因安全审查暂未开放。
2026 年 8 月 11 日,Google 宣布 Gemini 应用月活跃用户已超过 10 亿。公司称,Gemini 是 Google 有史以来增长最快的产品,也是第 14 个达到这一用户规模的 Google 产品。
这条增长曲线在过去一年明显加速:
这一里程碑说明 Gemini 正迅速成为面向大众的消费级产品。但“10 亿”指的是 Gemini 应用及其更广泛生态中的月活跃用户,并不等于付费用户数量,也不代表每位用户都在使用所有功能。Google 的官方公告确认了这一里程碑及其增长排名,其他报道则补充了此前的增长节点。
在 2026 年 8 月 12 日的 Made by Google 活动上,Google 又宣布了一批新的 Gemini Connected Apps(连接应用)。这些服务覆盖生产力、创意、本地服务、娱乐、音乐、家庭服务、健康和生活方式等领域,并计划在接下来数周内逐步推出。
此次公布的服务包括:
这些连接的目标,是减少用户在不同应用之间来回切换的需要。具体而言,用户可以通过 Granola 或 Otter.ai 获取会议摘要,通过 Wix 编辑网站,通过 Ticketmaster 搜索活动门票,使用 Fever 或 GetYourGuide 查找本地体验,并在支持的地区预订餐厅或医疗服务。
换句话说,Gemini 不再只是给出一个答案,而是开始成为连接多个服务的对话式操作入口。用户可以先描述目标,再由 Gemini 调用相应应用完成后续步骤;至于能否直接预订、购买或执行某项操作,则取决于具体服务的支持范围。
新连接的公布,并不意味着每个 Gemini 用户都能在当天使用所有服务。Google 表示相关功能将在数周内逐步推出,而可用的应用列表还可能因 Google 账号、Gemini 使用入口、设备、所在国家或地区以及语言而不同。
用户可以前往 Gemini 设置 → 连接的应用 查看自己的实际可用列表。连接前,也应打开对应服务的“了解详情”页面,确认支持的操作、暂不支持的操作以及示例提示词。
这一点尤其重要,因为不同市场看到的服务和上线时间可能并不一致。现阶段,更准确的理解是:Google 正在把 Gemini 建设成一个跨服务的平台,而不是所有列出的功能已经在每个地区同步上线。
综合来看,Google 正从三个层面推动 Gemini 成为更完整的 AI 助手:
当然,Omni 所描绘的“任意输入到任意输出”仍是一个会逐步扩展的产品路线图,其初始版本主要聚焦视频;连接应用也仍在分阶段、分地区推出。对 Gemini 来说,当前最清晰的变化,是用户规模与实际能力正在同时增长:一个拥有 10 亿月活用户的助手,开始具备更丰富的媒体创作能力,也逐渐能够协助用户处理分散在不同数字服务中的任务。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
Google 于 2026 年 8 月 11 日宣布,Gemini 应用月活跃用户已超过 10 亿,成为公司增长最快的产品;但新应用连接的可用性仍取决于地区、账号和设备。
Google 于 2026 年 8 月 11 日宣布,Gemini 应用月活跃用户已超过 10 亿,成为公司增长最快的产品;但新应用连接的可用性仍取决于地区、账号和设备。 Gemini Omni 是 Google DeepMind 推出的“任意输入到任意输出”多模态模型,当前的 Gemini Omni Flash 可根据文字生成 3 至 10 秒、720p 视频,并支持通过对话反复编辑。
Granola、Otter.ai、Wix、Ticketmaster、OpenTable 和 GetYourGuide 等新连接,正推动 Gemini 从回答问题,转向直接协助用户完成跨应用任务。