6秒の720p動画をわずか「約25秒」で生成。前世代機から倍近い高速化を実現し、クリエイターのアイデア検証を大幅に効率化 [1][12]。 AI動画の「不気味の谷」を克服。人物の手足の不自然な歪みや浮遊感を低減し、服の揺れや落下の加速など、現実世界の物理法則に忠実な映像を実現 [10]。
研究の答え

Create a landscape editorial hero image for this Studio Global article: What new AI video model did Elon Musk's xAI unveil on June 17, 2026, and what key improvements does Grok Imagine Video 1.5 offer over its pr. Article summary: On June 17, 2026, Elon Musk's xAI officially launched **Grok Imagine Video 1.5**, graduating it from preview to general release via the xAI API and the Grok Imagine app [1][2][10]. Here are the key improvements over its . Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Grok Imagine Video 1.5 Preview: xAI's Most Powerful AI Video Generator Yet. xAI's Grok Imagine Video 1.5 Preview has claimed #1 on the Image-to-Video Arena leaderboard with a +52" source context "Grok Imagine Video 1.5 Preview — xAI's #1 AI Video Generator" Reference image 2: visual subject "Free Shipping in th
イーロン・マスクが率いるxAIは2026年6月17日、主力の画像→動画生成AIモデル「Grok Imagine Video 1.5」の一般提供を正式に開始しました 。同社が「これまでで最高の画像→動画モデル」と称する本バージョンは、数週間前に業界ベンチマーク「Image-to-Video Arena」で首位を獲得した実力を引っ提げての登場です
。
今回のアップデートは単なるマイナーチェンジではありません。AI動画制作における長年の課題――生成速度、映像のリアリティ、音声の統合――に正面から取り組み、技術をより実用的で、創造的な現場に即したものへと進化させています 。
最も体感しやすい進化が、圧倒的な生成時間の短縮です。新たに搭載された「Fast」モードでは、わずか約25秒で6秒間の720p動画をレンダリングします。これは40秒以上を要した前モデルと比較して、ほぼ倍の高速化を達成したことになります 。
アイデア出しやプロトタイピングを繰り返す映像クリエイターや開発者にとって、この短縮は制作サイクルの半減を意味します。「生成ボタンを押して、一息つく間もなく次の案を試せる」――そんな高速なワークフローが現実のものとなりました 。
生成速度だけでなく、映像の「質」も根本から見直されています。従来のAI動画モデルは、人物の手足が不自然にねじれたり、物体がふわふわと浮遊したりする「アーティファクト(生成ノイズ)」に悩まされてきました 。
Grok Imagine Video 1.5では、こうしたモーションの一貫性が大幅に強化され、キャラクターやカメラの動きは格段にスムーズで自然なものへと進化しています。
より注目すべきは、物理法則のシミュレーション精度です。モデルは重量感と運動量を深く理解し、表現に反映するようになりました。例えば、人が歩けば衣服が自然に揺れ、物が落ちれば現実的な加速曲線を描きます。その結果、出力される映像はもはや「デジタルの寄せ集め」ではなく、物理的な重みを感じさせる、地に足の着いた仕上がりとなります 。
最も戦略的に重要な追加機能は、音声の自動生成・同期機能です。これは前バージョンには存在しなかった、全く新しい機能です 。
これまで、Grokで生成した映像に効果音や環境音をつけるには、外部の編集ソフトを使い、手作業で音を合わせる必要がありました。バージョン1.5では、映像の生成と同時に、その場面に合った環境音や効果音が自動的に作成され、映像の動きと完全に同期されます 。
この進化は、クリエイティブ制作における大きな「摩擦」を取り除きます。アーティストやコンテンツクリエイターは、一つの指示を出すだけで、映像と音声が一体となった完成度の高いワンシーンを手に入れられるようになるのです 。
今回の正式リリースは、2026年6月3日に始まったプレビュー版の大成功を受けてのものです 。プレビュー期間中、Grok Imagine Video 1.5は業界ベンチマーク「Artificial Analysis Video Arena」において急速に頭角を現し、旧バージョン1.0に**+52 Eloポイント**もの大差をつけて第1位に躍り出ました
。
この結果は、ByteDance(バイトダンス)の「Seedance 2.0」やGoogle(グーグル)の「Veo」といった強力な競合を上回るもので、CEOのイーロン・マスク氏も、自身のXで1800万回以上再生されたAI生成の『イリアス』予告編を共有し、その実力をアピールしました 。
なお、Grok Imagine Video 1.5は、同名のチャットボット「Grok」とはブランドを共有するものの、テキストと画像から動画を生成することに特化した独立したモデルです 。プレビュー期間を終えた現在、開発者はxAI APIを通じてモデル名
grok-imagine-video-1.5 で、一般ユーザーはWeb、iOS、Android向けの「Grok Imagine」アプリでアクセス可能です 。
同期音声を高速生成パイプラインに直接組み込むことで、xAIは、競争の激化するAI動画生成の舞台で、オールインワンの創作体験こそが次の覇権を握ると確信しているのです 。
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
6秒の720p動画をわずか「約25秒」で生成。前世代機から倍近い高速化を実現し、クリエイターのアイデア検証を大幅に効率化 [1][12]。
6秒の720p動画をわずか「約25秒」で生成。前世代機から倍近い高速化を実現し、クリエイターのアイデア検証を大幅に効率化 [1][12]。 AI動画の「不気味の谷」を克服。人物の手足の不自然な歪みや浮遊感を低減し、服の揺れや落下の加速など、現実世界の物理法則に忠実な映像を実現 [10]。
画像生成と同時に、効果音や環境音を自動で付与する「音声同期機能」を業界で初めて搭載。外部ツールでの音付け作業が不要になり、ワンストップの制作体験を提供 [2][10]。