本届 I/O 的最大亮点是 Gemini Omni。Google 将其描述为一种能够“从任何输入生成任何内容”的新一代模型,首个重点能力是 AI 视频生成。
用户可以组合多种输入类型,例如:
系统随后能够生成或编辑高质量视频内容,并利用 Gemini 的世界知识进行内容理解和创作。
目前推出的首个版本名为 Gemini Omni Flash,已经开始在 Gemini 应用和 Google 的创意工具中上线。未来 Google 计划让 Omni 支持更多输出形式,而不仅仅是视频。
这一步也让 Google 正面进入 生成式视频竞争赛道,与其他 AI 公司在视频生成和编辑能力上展开竞争。
Google 还在重新设计信息获取方式,其中一个例子就是 Ask YouTube 功能。
这个功能允许用户直接向 AI 提问视频内容,例如:“这段视频讲的关键步骤是什么?”系统会:
换句话说,用户不再需要从头观看长视频,而是可以像和助手对话一样快速获取信息。
这一功能也是 Google 推动 对话式搜索体验 的一部分。类似的 AI 交互正在逐步进入 Search、Maps 和其他产品,使传统搜索框转变为智能助手入口。
在办公工具方面,Google 推出了 Docs Live,为 Google Workspace 带来新的 AI 交互方式。
Docs Live 允许用户通过 语音对话 与文档互动,例如:
这一功能是 Google 将 Gemini 深度整合到 Workspace(如 Docs、Gmail、Drive)的重要一步,使 AI 成为日常工作流程中的助手。
Google 还宣布推出 Gemini Intelligence,这是面向 Android 设备的一组 AI 能力,目标是让手机变成主动协助用户的助手。
其功能包括:
这些功能预计首先登陆 部分 Samsung Galaxy 和 Google Pixel 手机,随后扩展到手表、汽车和笔记本等更多 Android 设备。
Google 的目标是让智能手机从“被动工具”变成 能预测需求并处理日常事务的系统。
与 Gemini Intelligence 相配合,Google 还展示了 Android 17。
Google 表示,Android 正在从传统的移动操作系统转变为一个 AI 驱动的“Intelligence System(智能系统)”。
Android 17 的重点改进包括:
由于大量功能依赖 设备端 AI 推理,最完整的体验将在较新的 Pixel 和 Samsung 设备上率先提供。
在模型和开发者生态方面,Google 发布了 Gemini 3.5 Flash。
这一模型强调 高性能与高速响应的结合,用于支持代码生成、自动化任务和 Agent 工作流等场景。
Google 还为开发者推出新的 Gemini API 功能,使他们能够通过一次调用创建 AI Agent,让其:
Google 将这一趋势总结为从 “提示(prompt)到行动(action)” 的转变。
从这些发布可以看出,Google 正在实施一个非常清晰的 AI 战略:让 Gemini 成为整个技术栈的核心层。
这包括:
Google 认为自己的优势在于 产品分发能力和基础设施规模——AI 可以通过现有产品迅速触达数十亿用户。
Google I/O 2026 释放的信号很明确:AI 不再只是一个单独产品,而是成为整个生态的基础能力。
这些变化共同指向一个目标:让 Gemini 成为 Google 产品之间的智能连接层,并在未来与 OpenAI 等 AI 平台争夺默认 AI 助手的位置。