Microsoft намеренно разделяет свою инфраструктуру нового поколения между AMD Helios и Nvidia Vera Rubin, чтобы снизить риски в цепочке поставок и избежать привязки к одному вендору . Это повторяет модель, которую компания использует в Azure и Copilot — независимость от конкретных моделей . Генеральный директор Сатья Наделла подтвердил: «Мы будем одними из первых облачных провайдеров, кто развернёт стоечные ИИ-системы следующего поколения на базе AMD Helios и Nvidia Vera Rubin». Это даёт Microsoft рычаги на переговорах и операционную гибкость, если один из вендоров столкнётся с ограничениями по поставкам . Отрасль описывает такой подход как «хеджирование ставок» при закупке ИИ-инфраструктуры .
Ни AMD, ни Microsoft не раскрыли точные цены, но аналитики из Futurum Group дают чёткое сравнение:
Таким образом, Helios примерно на 40% дороже в пересчёте на стойку . Надбавка объясняется большим объёмом памяти, открытой архитектурой и интегрированным портфелем AMD, включающим CPU, GPU и сетевые решения .
AMD утверждает, что более высокая начальная стоимость Helios оправдана превосходной эффективностью. Согласно собственным данным AMD, Helios обеспечивает :
Генеральный директор AMD Лиза Су представила эти показатели на мероприятии Advancing AI 2026, заявив, что Helios обеспечивает «на 15% и более высокую производительность на самых крупных моделях, на 50% больше ёмкости HBM и до 30% больше токенов на доллар» .
Однако аналитики предостерегают: это лишь предпроизводственные оценки. Futurum Group отметили: «Заявления AMD о превосходстве на 15% и 30% токенов на доллар — это математика вендора, применённая к ещё не отгруженному конкуренту. Всё будет проверено в реальной эксплуатации в течение двух кварталов» .
AMD Helios — это специализированная, жидкостно-охлаждаемая стоечная система, представляющая собой самое комплексное предложение AMD в области ИИ-железа на сегодняшний день :
| Компонент | Характеристика |
|---|---|
| GPU | 72 × AMD Instinct MI455X |
| Архитектура GPU | CDNA 5 (гибрид 2 нм / 3 нм чиплетов на TSMC) |
| Транзисторов на GPU | 320 миллиардов |
| CPU | 18 × 6-го поколения AMD EPYC «Venice» (один на вычислительный лоток, до 256 ядер на CPU) |
| Сеть | AMD Pensando «Vulcano» 800 AI NIC (800 Гбит/с Ethernet, до 2,4 Тбит/с scale-out на GPU) |
| Scale-up интерконнект | UALink (Ultra Accelerator Link, туннелированный через Ethernet) |
| Scale-out интерконнект | Ultra Ethernet Consortium (UEC) совместимый |
| Общий объём HBM4 | 31 ТБ на стойку |
| Память на GPU | 432 ГБ (12 стеков HBM4 по 36 ГБ каждый) |
| Пропускная способность памяти на GPU | 19,6 ТБ/с |
| Совокупная пропускная способность памяти | 1,7 ПБ/с на стойку |
| Производительность FP4 | 2,9 эксафлопс на стойку |
| Производительность FP8 | 1,4 эксафлопс на стойку |
| Пропускная способность scale-up | 260 ТБ/с |
| Пропускная способность scale-out | 43 ТБ/с |
| Форм-фактор | 18 жидкостно-охлаждаемых вычислительных лотков (по 4 GPU) + 6 коммутационных лотков, совместимость с OCP Open Rack Wide |
| Производительность на GPU | 40 PFLOPS FP4, 20 PFLOPS FP8 |
Каждый вычислительный лоток содержит четыре GPU MI455X, один CPU EPYC Venice и сеть Pensando — все компоненты соединены протоколом UALink, что позволяет 72 GPU работать как единый вычислительный блок .
AMD подтвердила следующих ранних заказчиков Helios :
Примечательное отсутствие: Anthropic не был публично назван в числе ранних заказчиков Helios по состоянию на июль 2026 года .
Решение Microsoft развернуть и AMD Helios, и Nvidia Vera Rubin сигнализирует о новой фазе рынка ИИ-аппаратного обеспечения. Вместо зависимости от одного вендора, гиперскейлеры инвестируют в разнообразие платформ, чтобы обеспечить поставки, улучшить переговорные позиции и получить доступ к различным характеристикам производительности .
AMD Helios, с её огромными 31 ТБ памяти HBM4 и открытым Ethernet-интерконнектом, особенно хорошо подходит для крупномасштабных задач инференса, где объём и пропускная способность памяти напрямую влияют на пропускную способность и стоимость токена . Ожидается, что поставки начнутся во второй половине 2026 года, и настоящая проверка наступит, когда будут опубликованы производственные бенчмарки, позволяющие проверить конкурирующие заявления в реальных масштабах .