単純なシングルコアの一騎打ちではなく、AMDは思考実験を提案する。各プラットフォームに100kWのラック電力枠を与え、現実世界のエージェント処理をどれだけ多く捌けるかを見よう、というものだ。そのシナリオにおいて、AMDの内部モデルは、同社のハイコア数のEPYCプロセッサがNVIDIAのVeraを劇的に上回ることを示している。一つ一つのコアが圧倒的に速いからではなく、優れた電力効率によって、同じ電力枠内により多くのコアを詰め込めるからである。
AMDのモデル比較は、すべてのプラットフォームを100kWのデュアルソケット(2P)サーバーラックに正規化している。エージェントAIの中核をなす6つのワークロード、すなわち「SPECrate 2017整数演算性能」「サーバーサイドJava」「NGINX Webサーバー」「Redis」「Memcached」「リレーショナルデータベース」を組み合わせ、幾何平均スループットスコアを算出。Veraをベースライン(1.00倍)としている。
| プラットフォーム | CPUあたりのコア数 | 正規化ラックレベルスループット (幾何平均) |
|---|---|---|
| NVIDIA Vera (88C, Olympus ARM) | 88 | 1.00x (ベースライン) |
| Intel Xeon 6980P (128C, Granite Rapids-AP) | 128 | 1.46x |
| AMD EPYC 9965 "Turin" (192C, Zen 5) | 192 | 2.37x |
| AMD EPYC "Venice" (256C, Zen 6) | 256 | 3.30x (予測値) |
特に、次期VeniceチップのVeraに対するワークロード別の予測値は非常に攻めており、整数演算性能で2.40倍、リレーショナルデータベースのトランザクション処理(TPROC-C)に至っては4.05倍という優位性を試算している。
意見の相違は、物理学と効率性の基本的な計算に帰着する。AMDのモデルは、同社のチップがVeraよりも低い正規化2Pノード電力を実現すると推定している。ラックの上限が100kWに制限されている場合、ノードあたりの消費電力が低ければ、物理的により多くのサーバーを設置できる。AMDの分析によると、Veraラックの正規化ノード数が1.00倍であるのに対し、EPYC 9965ラックは1.86倍、Veniceラックに至っては2.08倍の正規化コア数を収容できる計算になる。
ラックレベルのスループットは、「ノードあたりの性能」と「ラックあたりのノード数」の積で計算される。仮にVeraがコア単位でわずかに高速だったとしても(初期の独立ベンチマークでは一部のタスクでそれが裏付けられている)、AMDの主張は、電力制約のあるラック環境において、より電力効率の高い設計によってもたらされる圧倒的なコア数の優位性を覆すことは数学的に不可能だ、というものだ。
しかしながらAMDは、コアあたりの性能そのものについても主張を展開している。その方法論文書では、64コアのVenice CPUがVeraの88コアプロセッサと比較して、コアあたりのSPECrate性能で27%高いと推定。また、96コアのVeniceチップでも、11%のコアあたり性能優位を維持するとしている。
これは古典的なベンチマークのフレーミング合戦であり、各社が自社の設計思想に最も適した尺度を選択しているのである。
AMDの発表した数値は非常に印象的だが、割り引いて考える必要がある。
各製品の生産スケジュールは、競争の構図をさらに複雑にしている。
両社のチップが一般提供に近づくにつれ、この議論はついに、ベンダーのスライド資料から、第三者のデータセンターによる実地テストへと移行するだろう。それまでは、「どちらのCPUが速いか」という答えよりも、読者の皆さんがこれから構築しようとしているインフラの評価軸を、実際に稼働させる特定のワークロードにしっかりと合わせることが最も有益な結論と言えるだろう。