在速度之外,Grok Imagine Video 1.5 着力解决了长期困扰 AI 视频模型的画面瑕疵问题。上一代产品常因运动连贯性不足而出现肢体不自然扭曲、物件“漂浮”等明显破绽 。1.5 版本在很大程度上修正了这些行为,呈现出更为流畅自然的人物动作和镜头运动
。
更细致的变化体现在物理模拟能力的升级上。模型现在能够诠释更微妙的重量感和动量,比如能够渲染人物行走时衣摆的自然晃动,或者物体下落时符合现实规律的加速轨迹。这让生成出的视频片段更有物理世界的真实质感,而非仅仅是数字拼贴 。
此番更新战略意义最为重大的,莫过于 内置同步音频生成功能 的导入,这一点是前代产品所完全不具备的 。以往,为 Grok 生成的视频配上声音,需要借助外部工具并手动调整音画同步。如今,1.5 版本能够在生成画面的同时,自动匹配环境音、音效和氛围音,使音频与屏幕上的动作紧密相扣
。这种一体化的生成方式消除了创作流程里的一大摩擦点,让艺术家和内容创作者可以一步到位,直接得到一个完整的视听片段
。
此次发布前,xAI 在 2026 年 6 月 3 日启动了预览期。在此期间,Grok Imagine Video 1.5 迅速在行业基准测试中证明了自己的实力。它在 Artificial Analysis 的 Video Arena 排行榜上强势登顶,ELO 评分相较前代 1.0 模型实现了 +52 分的巨大跃升 。它的成绩一举超越了包括字节跳动 Seedance 2.0 和谷歌 Veo 在内的强劲对手。作为推广,xAI 首席执行官埃隆·马斯克分享了一段由该模型生成的《伊利亚特》AI 预告片,该视频在 X 平台上迅速斩获了超过 1800 万次的观看量
。