Huawei заявляет, что Atlas 960E сможет объединять 4096 NPU в SuperPoD с единой адресацией памяти и обеспечивать 8 ЭФЛОПС FP8 либо 16 ЭФЛОПС FP4. UnifiedBus, по данным Huawei, сводит более десяти протоколов межсоединений к единому протоколу и семантике памяти.
ОпубликовалОтредактировано с помощью GPT-5.6 TerraИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: How is Huawei’s new AI computing architecture—centered on the near-packaged-optics Atlas 960E SuperPoD, Ascend 960 chips, and UnifiedBus int. Article summary: Huawei’s approach is to treat communication and memory access—not just accelerator throughput—as the limiting resource in giant AI clusters. It combines tightly coupled Ascend NPUs, a single UnifiedBus protocol and memor. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
В сверхкрупных системах для обучения ИИ скорость работы определяется уже не только вычислительной мощностью ускорителей. Не меньшей проблемой становятся обмен параметрами, активациями, кэшами и обращениями к памяти между тысячами процессоров. Huawei строит свою новую инфраструктуру вокруг именно этого узкого места: Atlas 960E SuperPoD, будущих ускорителей Ascend 960 и коммутационной архитектуры UnifiedBus.
Важно учитывать: заявленные Huawei показатели производительности, энергоэффективности и масштабирования — это характеристики и прогнозы самой компании, а не независимо подтверждённые бенчмарки. 9
18
В традиционных крупных кластерах центральные процессоры, ИИ-ускорители, накопители и память обычно остаются разными ресурсами, связанными несколькими протоколами. Huawei утверждает, что UnifiedBus объединяет более десяти протоколов межсоединений в единый протокол и единую семантику памяти. Это должно позволить CPU, NPU, памяти и SSD обращаться друг к другу напрямую в одноранговом режиме. 18
Практический смысл — сократить простои при передаче данных. Вместо постоянного копирования данных и явной координации работы изолированных узлов ПО сможет адресовать память по всему SuperPoD как единое пространство. Такой подход призван сделать распределённую память общим пулом — особенно для моделей и промежуточных данных, которые не помещаются в локальной памяти одного ускорителя. 18
По оценке Huawei, UnifiedBus переводит пропускную способность межсоединений с уровня порядка 100 ГБ/с на уровень ТБ/с, а задержку полного цикла передачи данных (RTT) снижает примерно с 7 до 2 микросекунд. Это целевые показатели архитектуры Huawei, а не универсальное независимое сравнение с конкурирующими платформами. 18
Atlas 960E SuperPoD объединяет будущие процессоры Ascend 960, UnifiedBus и оптический модуль Hi-ONE с технологией near-packaged optics (NPO) — размещением оптических компонентов максимально близко к чиповой упаковке. Huawei называет систему первым в отрасли SuperPoD на базе NPO; она имеет полностью жидкостное охлаждение и рассчитана на обучение и инференс моделей до 10 трлн параметров. 9
Заявленная конфигурация включает 4096 NPU с единой адресацией памяти. Huawei указывает производительность до 8 ЭФЛОПС в FP8 или 16 ЭФЛОПС в FP4. 9
Оптика здесь необходима потому, что при росте пропускной способности и размера кластера электрические соединения всё труднее масштабировать. По данным Huawei, один оптический двигатель Hi-ONE обеспечивает 7,2 Тбит/с. В проекте системы на 4096 NPU около 5500 таких двигателей должны заменить примерно 48 000 обычных оптических модулей 800G. Компания утверждает, что это сократит энергопотребление более чем на 550 кВт и поднимет доступность до 99,8%. Все эти цифры являются расчётами Huawei для собственной архитектуры. 9
Huawei также представила компоненты для соединений внутри стойки, между стойками и между SuperPoD:
Для организаций, которым не нужен SuperPoD такого масштаба, Huawei предлагает Atlas 650E: систему с полносвязной конфигурацией из 16 NPU на базе UnifiedBus Link 2.0. Для неё заявлены пропускная способность встроенной памяти до 4,0 ТБ/с при чтении и записи, а также 13,4 ТБ/с по UB Link на сервер с 16 NPU. 20
Huawei сообщает, что разработка Ascend 960 идёт быстрее ожиданий и что плановая производительность удвоилась. При этом компания не опубликовала подробностей независимых тестов, которые позволили бы проверить такое утверждение. 11
Текущий график выглядит так:
Huawei также заявляла, что системы предыдущего поколения Atlas 950 SuperPod уже используются в крупных коммерческих развёртываниях. Это не означает, что в эксплуатации уже находятся Atlas 960E: данная система привязана к ещё не вышедшему поколению Ascend 960. 3
9
По своей задаче UnifiedBus близок к тому, что решает Nvidia NVLink: обеспечить быстрый обмен данными между множеством ускорителей, чтобы рост числа чипов давал полезный прирост вычислений, а не увеличивал потери на синхронизацию и передачу данных.
Huawei называет своими отличиями более широкое объединение протоколов, глобальную адресацию памяти внутри SuperPoD, прямой доступ между разнородными компонентами и использование NPO на уровне всего SuperPoD. 18
9
Но имеющиеся материалы не позволяют провести равноправное сравнение UnifiedBus и NVLink по пропускной способности, задержкам, зрелости ПО, надёжности, стоимости или фактической скорости обучения моделей. Также нет оснований считать UnifiedBus открытым межвендорным стандартом, сопоставимым по модели управления и целям совместимости с инициативами открытых соединений ускорителей. UnifiedBus представлен как собственная архитектура и экосистема Huawei. 18
Значимость анонса в том, что Huawei выносит системную архитектуру — межсоединения, оптику, топологию сети и модель памяти — в центр своей ИИ-стратегии. Это может быть особенно важно для задач, где ограничением служат не только вычисления одного чипа, но и коммуникации с доступной памятью.
Окончательную оценку дадут поставки Ascend 960 и Atlas 960E, измеримые показатели обучения и загрузки ускорителей на реальных задачах, зрелость инструментов разработки, надёжность при большом масштабе и способность выпускать системы в значительных объёмах. До этого SuperPoD на 4096 NPU и SuperCluster на 1 млн NPU остаются амбициозными архитектурными целями, а не независимо подтверждёнными результатами. 9
11
18
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Huawei заявляет, что Atlas 960E сможет объединять 4096 NPU в SuperPoD с единой адресацией памяти и обеспечивать 8 ЭФЛОПС FP8 либо 16 ЭФЛОПС FP4.
Huawei заявляет, что Atlas 960E сможет объединять 4096 NPU в SuperPoD с единой адресацией памяти и обеспечивать 8 ЭФЛОПС FP8 либо 16 ЭФЛОПС FP4. UnifiedBus, по данным Huawei, сводит более десяти протоколов межсоединений к единому протоколу и семантике памяти.
Ascend 960DT намечен на I квартал 2027 года, Ascend 960PR — на III квартал 2027 года; оба релиза перенесены на более ранний срок относительно прежнего плана Huawei.