マイクロソフトは、サプライチェーンリスクの低減と特定ベンダーへの過度な依存(ベンダーロックイン)を回避するため、次世代AIインフラをAMD HeliosとNvidia Vera Rubinに意図的に分割しています 。これは、AzureやCopilot全体で採用しているモデルにとらわれないアプローチ(モデルアグノスティック戦略)を反映したものです 。CEOのサティア・ナデラ氏は「我々はAMD HeliosとNvidia Vera Rubinの両方をベースにした次世代ラックスケールAIインフラを展開する最初のクラウドプロバイダーの一つとなる」と明言しており、一方のベンダーに割り当て制約が生じた場合でも交渉力と運用の柔軟性を確保できるとしています 。業界ではこの戦略を「AIインフラ調達におけるリスクヘッジ」と広く評価しています 。
AMDもマイクロソフトも正確な価格は非公表ですが、Futurum Groupのアナリスト推計によると明確な差が示されています:
Heliosはラック単位で約40%高価ということになります 。このプレミアム価格は、Heliosの大容量HBM4メモリ、オープンアーキテクチャ、そしてAMDがCPU・GPU・ネットワークを統合したポートフォリオを提供している点に起因するとされています 。
AMDは、Heliosの初期コストが高いものの、優れた性能効率によって正当化されると主張しています。AMD自社の実験データによれば、Heliosは以下の性能を発揮します :
AMDのCEO、リサ・スー氏は「Advancing AI 2026」イベントでこれらの数値を発表し、Heliosは「最大規模のモデルにおいて競合より15%以上の性能、50%多いHBM容量、そして最大30%多いトークン/ドルを提供する」と述べています 。
ただし、アナリストはこれらが量産前の推定値であると警告しています。Futurum Groupは「AMDの15%の性能優位性と30%のトークン/ドル優位性は、まだ出荷されていない競合製品を相手にしたベンダー計算であり、実際の生産環境で2四半期以内に検証されるだろう」と指摘しています 。
AMD Heliosは、液冷式の専用設計ラックスケールシステムであり、同社がこれまでに提供した中で最も包括的なAIハードウェア製品です :
| コンポーネント | 仕様 |
|---|---|
| GPU | 72基のAMD Instinct MI455X |
| GPUアーキテクチャ | CDNA 5(TSMCでの2nm/3nmチップレットハイブリッド) |
| トランジスタ数(GPUあたり) | 3200億 |
| CPU | 18基の第6世代AMD EPYC "Venice"(コンピュートトレイあたり1基、CPUあたり最大256コア) |
| ネットワーキング | AMD Pensando "Vulcano" 800 AI NIC(800Gbpsイーサネット、GPUあたり最大2.4Tbpsのスケールアウト帯域幅) |
| スケールアップ相互接続 | UALink(Ultra Accelerator Link、イーサネット上をトンネリング) |
| スケールアウト相互接続 | Ultra Ethernet Consortium(UEC)準拠 |
| 総HBM4メモリ | ラックあたり31TB |
| GPUあたりのメモリ | 432GB(36GBのHBM4スタック×12) |
| GPUあたりのメモリ帯域幅 | 19.6TB/s |
| 総メモリ帯域幅 | ラックあたり1.7PB/s |
| FP4性能 | ラックあたり2.9エクサFLOPS |
| FP8性能 | ラックあたり1.4エクサFLOPS |
| スケールアップ帯域幅 | 260TB/s |
| スケールアウト帯域幅 | 43TB/s |
| フォームファクタ | 18基の液冷コンピュートトレイ(各4GPU)+ 6基のスイッチトレイ、OCP Open Rack Wide準拠 |
| GPUあたりの性能 | 40PFLOPS FP4、20PFLOPS FP8 |
各コンピュートトレイには4基のMI455X GPUと1基のEPYC Venice CPU、Pensandoネットワーキングが搭載され、UALinkプロトコルによって接続されることで、72基のGPUが1つのコンピュートユニットとして機能します 。
AMDは以下の早期Helios顧客を確認しています :
特筆すべき不在として、Anthropicは2026年7月時点の主要発表において、初期のHelios顧客として公に名前が挙がっていません 。
マイクロソフトがAMD HeliosとNvidia Vera Rubinの両方を導入する決断は、AIハードウェア市場が新たなフェーズに入ったことを示しています。単一ベンダーへの依存ではなく、ハイパースケーラー(大規模クラウド事業者)は供給確保、交渉力の強化、差別化された性能特性へのアクセスを目的として、プラットフォームの多様化に投資し始めているのです 。
AMD Heliosは、その大容量31TBのHBM4メモリとオープンなイーサネットベースの相互接続により、特に大規模推論ワークロードに適しており、メモリ容量と帯域幅がスループットとトークン単価に直接影響を与える領域で強みを発揮します 。2026年後半の出荷開始が見込まれており、実際の生産ベンチマークが公開され、競合する主張が大規模に検証される段階で、真の評価が下されることになるでしょう 。