后续还有报道称,Gemini 移动端应用中出现了另一段文案:“Meet our new video model. Remix your videos, edit directly in chat, try a template, and more.” 如果这段文案准确,它指向的就不只是一个后端模型名,而更像是一个能在 Gemini 内完成视频生成、改编和编辑的产品体验。
至于网上流传的早期演示和视频片段,证据强度要低得多。Gadgets360 称早期演示展示了更真实的运动、更干净的文字渲染和更好的场景构图;也有 YouTube 讨论提到,X 上流传的两段视频元数据据称指向“Google Gemini Omni Mode”。 但这些片段没有被独立验证为 Omni 输出,Google 也尚未在所给资料中正式发布 Omni。
从目前泄露的文案看,Omni 最值得关注的不是单一参数,而是创作流程:
Veo 3.1 是现在可以确认的参照系。Google 已经发布 Veo 3.1 和 Veo 3.1 Fast,并通过 Gemini API、Google AI Studio 和 Vertex AI 以付费预览形式提供,同时也让 Veo 3.1 进入 Gemini 应用和 Flow。 Google 对 Veo 3.1 的官方描述包括更丰富的原生音频、更强的叙事控制,以及从图像生成视频时更好的输出效果。
Google 还在继续扩展 Veo 3.1 家族。2026 年 1 月,Google 称 Veo 3.1 可以从图像生成更有表现力的视频,支持适合 YouTube Shorts 等平台的竖屏视频,并可在 Gemini、Flow、Gemini API、Vertex AI 和 Google Vids 等产品中提升到 1080p 或 4K。 2026 年 3 月,Google 又推出 Veo 3.1 Lite,称其是成本最低的视频模型,成本低于 Veo 3.1 Fast 的 50%,同时保持相同速度。
放在这个背景下,Omni 泄露并不能证明它一定是“参数全面跃升”的下一代模型。更清晰的差异在工作流:模板、聊天内编辑、视频 Remix,以及与 Gemini 的一体化体验。 至于更真实的运动、更干净的文字、更好的构图,这些说法可能成立,但目前还没有 Google 官方模型卡、基准测试或可复现的公开测试来支撑。
现在三种可能都还没坐实。
第一种可能:Omni 是现有或升级版 Gemini 视频路径的新标签。WaveSpeed 的报道提到,“Powered by Omni”这段文案出现在“Toucan”附近,而 Toucan 被其描述为 Gemini 当前由 Veo 3.1 驱动的视频工具内部名。 如果这个位置判断准确,Omni 可能是替换路径、测试开关,或新一代生成流程的面向用户名称。
第二种可能:Omni 是一个真正的新视频模型。相关移动端文案用了“Meet our new video model”的说法,Gadgets360 也将 Gemini Omni 描述为可能让用户直接在 Gemini 内创建和编辑视频的模型。
第三种可能:Omni 属于更大的多模态系统。一些爆料汇总猜测,Omni 可能会统一文本、图像、视频和音频的生成或推理能力。 这在产品方向上并非不合理,但仍然只是所给资料中的推测。Google 尚未确认“Omni”到底是公开产品名、内部代号、模型家族、UI 层,还是更大的架构名称。
更可参考的是 Veo 的路线:Google 已经把 Veo 3.1 家族按成本和性能做了分层,Veo 3.1 Lite 被定位为低成本选项,成本低于 Veo 3.1 Fast 的一半,同时保持相同速度。 这说明 Google 确实在考虑视频生成的经济性,但不能反推出 Omni 一定昂贵、限量、只面向高级用户,或只开放给开发者。
因此,关于 Omni 很慢、很贵、只给内部测试者使用,或只能生成短片的说法,在 Google 或可验证测试者拿出证据前,都应视为未确认。
目前无法做严肃的头对头排名。现有资料没有提供 Runway、Pika 或 OpenAI Sora 的可比基准数据,而 Omni 本身也缺少足以判断真实感、可控性、生成长度、时间一致性、安全机制和成本的公开证据。
唯一比较稳妥的判断,是产品定位。如果泄露的 Gemini 文案准确,Google 可能不只想拼单次生成质量,还想把“提示词输入、选择模板、视频 Remix、聊天内编辑”放进同一个 Gemini 界面里完成。 这可能成为它相对于独立 AI 视频工具的差异点,但不能证明 Omni 在画质或能力上已经超过 Sora、Runway 或 Pika。
接下来真正值得看的问题很明确: