Frozen v2は、Googleがこれまで展開してきたTensor Processing Units(TPU)のような汎用テンソルプロセッサではない。TPUはソフトウェアの再構成によって幅広いAIモデルをサポートするプログラム可能なアクセラレータである。Frozen v2はその正反対で、Geminiの特定のアーキテクチャ——そのレイヤー、演算子、データフロー——を製造段階でチップに焼き付け、単一目的の「Gemini-in-a-chip」とするものだ。
| 項目 | 既存TPU(Ironwood、TPU 8i/8t) | Frozen v2 |
|---|---|---|
| 設計思想 | 汎用AIアクセラレータ。プログラム可能な行列演算ユニット、柔軟なデータフロー | 固定機能ASIC。Geminiのアーキテクチャをシリコンに埋め込み、フィールドでのプログラミングは不可 |
| 効率目標 | 多様なモデルでトレーニングと推論に優れる | Gemini推論に特化し、最新TPU比で6~10倍のトークン/ワット |
| メモリモデル | HBM + SRAMに動的にモデル重みをロード | モデル重みと計算経路をマスクROM/ハードワイヤード論理に直接埋め込み |
| 柔軟性 | ソフトウェア再構成で任意のモデルを実行可能 | 1モデル(Gemini)のみ。実行時のモデル切り替え不可 |
この効率性が最大の見出しだ。Googleのエンジニアらは、Frozen v2が最新TPUチップと比較して、消費電力あたり6倍から10倍のAIトークンを生成できると試算している。
The Informationの報道と関連記事によれば、Frozen v2は早ければ2028年の導入を目標としている。つまり、このチップはまだ量産まで数年を要し、現行の第8世代TPUファミリー(Sunfish、Zebrafish)が展開・成熟した後に初めてサービスインする見込みだ。
スタートアップの Taalas は、このトレードオフが実際に何を意味するかを如実に示している。2026年2月、Taalasは HC1チップ を発表。Llama 3.1 8Bモデルのすべてのパラメータを、マスクROMを用いてチップのトランジスタ回路に直接エンコードし、重み格納用の外部HBMを完全に排除した。
その性能は驚異的だ:
その代償も同様に劇的だ:
Taalasの創業者は、このアーキテクチャを「マスクROMリコールファブリック」と「SRAMリコールファブリック」の組み合わせと説明する。これにより、モデルとKVキャッシュの全計算をオンチップで実行し、外部メモリとのデータ移動を完全に排除する。Frozen v2も基本的に同じアプローチを採用するものと見られる。
GoogleのAI計算能力は極度に逼迫しており、支払い能力のある巨大顧客に対してもアクセスを制限し始めている。いくつかのデータポイントがその動機を明確にしている。
Metaへの容量拒否(2026年3月): Googleは2026年3月、Metaが購入を希望したGemini計算能力の全量を供給できないと伝えた。この不足は、Metaの社内AIプロジェクトの一部を遅延させ、Metaはエンジニアに対してAIトークンの節約を指示せざるを得なくなった。
受注残高の数字: Google Cloudの受注残高は2026年第1四半期にほぼ倍増し、4620億ドル に達した。これは同社の利用可能な処理能力の約 23倍 の需要に相当する。サンダー・ピチャイCEOは決算電話会見で次のように認めている。「短期的には計算資源が制約されています。その需要に応えられていれば、クラウド収入はさらに高かったでしょう」。
広範な能力不足: Googleはこの計算ギャップを埋めるため、SpaceXから月額約9億2000万ドルでNvidia GPUをリースしている。Google CloudのVPであるアミン・ヴァダット氏は2025年11月、需要に対応するには6ヶ月ごとにAI容量を倍増する必要があると述べていた。
これらの制約がFrozen v2を直接動機づけている。もしGoogleがGemini推論で6~10倍のワットあたり効率を達成できれば、新しいデータセンターを建設しなくても実効容量を飛躍的に増やせるからだ。
Frozen v2は、はるかに大規模なハードウェア戦略の一部に過ぎない。
1. 第8世代TPUの訓練用・推論用への分割。 Cloud Next 2026で、Googleは第8世代TPUファミリーを初めて2つの専用バリアントに分割してプレビューした。
2. Broadcomとの2031年までの長期契約。 BroadcomはSECへの8-K提出書類で、Google向け将来世代カスタムTPUを開発・供給する長期契約と、ネットワーキング部品の供給保証契約を2031年まで締結したことを開示した。別途、Anthropicは2027年以降稼働開始予定の約3.5GWのGoogle TPU容量を確保する契約を結んでいる。
3. OpenAIを含む顧客へのTPUレンタル。 Googleは外部AI企業向けにTPU容量をレンタル製品として提供し始めており、OpenAIも顧客として名が挙がっているとの報道がある。
4. MediaTekとの「Icefish」プロジェクト。 「Icefish」というコードネームは、TPU 8iを超えたMediaTekのGoogle向けカスタムチッププロジェクト——おそらく低消費電力のエッジ向けまたは推論アクセラレータ——に関連しているようだ。
5. Intelとの協議。 GoogleはIntelともカスタムAIチップ設計について協議を行ったと報じられているが、正式な合意は発表されていない。
6. Ironwood(第7世代TPU)の一般提供。 Ironwoodは2026年4月にクラウド顧客向けに一般提供が開始された。3nmプロセス、デュアルチップレットアーキテクチャで構築され、Geminiエコシステムを支えるMoEモデル向けに最適化されている。
The Informationの報道では、Frozen v2はGoogleのTPUロードマップを補完するものであり、代替するものではないと明記されている。その論理は明快だ。
これは、ハイパースケーラーが汎用CPUをほとんどのワークロードに使いながら、特定の高負荷タスク(ビデオトランスコーディング、ネットワークオフロードなど)に固定機能ASICを用いるのと類似している。Frozen v2はそのAI版であり、プログラム可能なTPUフリートと並んで動作する、目的特化型の推論エンジンなのである。