与传统流水线模型不同,Gemini Omni Flash 将文本、图片、音频和视频作为统一输入处理,直接输出视频 —— 这一能力被称为“任意到任意” AAB。模型可生成 3–10 秒、720p、24fps、同步原生音频 的短片,支持 16:9、9:16 或 1:1 三种宽高比 HG。
最大的亮点是 对话式视频编辑,由 Interactions API 驱动 AA。用户无需导出到外部编辑软件,直接通过自然语言迭代修改输出——替换角色、替换产品、风格迁移、添加物体、重新打光——模型会保留用户想要保留的部分 AA。每一轮对话都生成新的视频,模型能理解前几轮的上下文 A。
API 定价为 每生成一秒视频 0.10 美元,即 10 秒短片 1 美元 AH。这一定价与 Veo 3.1 Fast 一致,使 Omni Flash 成为低成本、快速迭代的视频工作流替代方案 Y。此外,输入 Token 价格为每百万 1.50 美元,视频输出 Token 价格为每百万 17.50 美元 H。
消费者方面,年满 18 岁的 YouTube Shorts 用户可以 免费使用 Gemini Omni Flash AWN。Google AI Plus、Pro 和 Ultra 订阅用户也可使用 AG。
10 秒短片上限是发布之初的刻意产品决策,更长时长将在未来版本推出 HY。Google 将此举描述为负责任的推出策略,在能力与安全之间取得平衡 T。有评论指出,这个限制更可能是部署层面的策略,而非模型架构的限制 N。
所有由 Omni Flash 生成或编辑的短片均内置 不可见的 SynthID 数字水印 YNN。用户可通过 Gemini 应用、Chrome 中的 Gemini 以及 Google 搜索 询问“这个视频是用 Google AI 创建的吗?”来进行验证 NB。在受支持的 Google 平台上,内容还会携带 C2PA 内容凭证 NC。API 没有关闭水印的开关 DG。
2026 年 7 月 1 日,Adobe 将 Gemini Omni Flash 作为合作伙伴模型加入 Adobe Firefly,用户可以通过 Firefly 的界面和积分系统进行自然语言视频编辑 D。费用为 每秒视频 30 个积分 D。这延续了 Google I/O 上宣布的更深层次合作,旨在将 Adobe 连接器引入 Gemini B。用户可以在“文本转视频”模块的模型下拉菜单中找到它 A。
与 Omni Flash 一同发布的还有 Nano Banana 2 Lite(模型 ID:gemini-3.1-flash-lite-image),它是 Google Nano Banana 系列中 最快、最便宜的图片模型 AA。可在 4 秒内生成图片,成本 低于每 1000 张 0.04 美元 BHB。该模型于 2026 年 6 月 30 日 在 Google Cloud 上正式可用,并已集成到 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform HCB。
总之,Gemini Omni Flash 为 AI 视频创作和编辑开启了一个全新的、更自然的交互模式,但其当前限制也体现了 Google 在能力与责任之间的审慎权衡。