つまり、アプリごとに操作するのではなく、AIアシスタントと会話しながらドキュメント・メール・メモを扱う体験を目指しているわけです。
目玉機能の一つがDocs Liveです。これは、話すだけでドキュメントの作成や編集ができる機能です。
例えばデモでは、ユーザーがGeminiに次のような内容を話しかけるだけで文書の下書きが生成されました。
Geminiは単に文字を書き起こすのではなく、内容を整理して構造化された文書として生成します。さらに、ユーザーの許可があればGmail、Drive、Google Chat、Webなどから関連情報を取得して文書を補強することもできます 。
この仕組みは、単なる音声入力というよりも、AI編集者と共同作業する感覚に近いとされています。
メモアプリのGoogle Keepにも、音声中心の新しい使い方が追加されます。
ユーザーは思いついたことをそのまま話すだけでよく、Googleが「ブレインダンプ(頭の中を一気に吐き出す)」と呼ぶ使い方を想定しています。
Geminiはその音声を処理し、次のように整理します。
これにより、雑然とした音声メモでも、後から使いやすい形のノートに自動整形されます 。
Gmailにも音声ベースの操作が加わります。
ユーザーはGeminiに話しかけるだけで、受信トレイにある情報を探せます。例えば次のような質問です。
Geminiは関連するメールを読み取り、会話形式で答えます。つまり、メールボックスが音声で検索できる情報データベースのように使えるようになります 。
Googleによると、AIへの指示は音声のほうが自然に伝えやすい傾向があります。
キーボードで入力する場合、多くの人は短い指示を何回にも分けて入力します。一方、音声では長くて具体的な指示を一度に伝えることが多いため、AIが意図を理解しやすくなるといいます 。
さらに最新の音声・言語モデルによって、Geminiは次のようなことが可能になりました。
たとえば、文書の内容を説明しながら途中で「やっぱりトーンをもっとカジュアルにして」と追加しても、Geminiは最終的な意図を反映して処理できるとされています 。
Googleによると、これらの音声機能は2026年夏から順次提供開始予定です。
初期段階では以下のユーザーが対象になります。
最初は英語で、AndroidとiOS向けに展開される予定です 。
今回の発表は、単なる新機能以上の意味を持ちます。
Googleは、ドキュメント、メール、メモといったアプリを個別に操作するのではなく、AIとの会話を中心に仕事を進める新しい作業スタイルを目指しています。
もしこの流れが定着すれば、将来のオフィスソフトは「入力して操作するツール」ではなく、話しかけて仕事を進めるパートナーに近づいていくのかもしれません。