Huawei заявляє, що Atlas 960E зможе об’єднати 4 096 NPU в єдиному просторі адресації пам’яті та забезпечити 8 EFLOPS у FP8 або 16 EFLOPS у FP4. UnifiedBus має звести понад 10 протоколів з’єднання до однієї моделі пам’яті, щоб CPU, NPU, накопичувачі та пам’ять могли напряму обмінюватися даними.
ОпублікувавВідредаговано за допомогою GPT-5.6 TerraЗображення створено за допомогою GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How is Huawei’s new AI computing architecture—centered on the near-packaged-optics Atlas 960E SuperPoD, Ascend 960 chips, and UnifiedBus int. Article summary: Huawei’s approach is to treat communication and memory access—not just accelerator throughput—as the limiting resource in giant AI clusters. It combines tightly coupled Ascend NPUs, a single UnifiedBus protocol and memor. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
У новій ШІ-інфраструктурі Huawei головним обмеженням вважає не лише обчислювальну потужність прискорювачів. На масштабі тисяч процесорів значну частину часу може забирати передавання параметрів моделі, активацій, кешів і звернення до пам’яті. Відповіддю компанії мають стати SuperPoD Atlas 960E, майбутні процесори Ascend 960 та мережа UnifiedBus. Важливе застереження: наведені показники продуктивності й енергоефективності є заявами Huawei, а не незалежно підтвердженими бенчмарками. 9
18
У традиційних великих кластерах CPU, прискорювачі, сховища та пам’ять часто залишаються окремими ресурсами, з’єднаними кількома протоколами. Huawei стверджує, що UnifiedBus об’єднує понад 10 протоколів інтерконекту в один протокол і спільну семантику пам’яті. Це має дати CPU, NPU, пам’яті та SSD прямий одноранговий доступ один до одного. 18
Практична мета — зменшити очікування під час обміну даними. Замість постійного копіювання або явної координації між ізольованими вузлами програмне забезпечення зможе адресувати пам’ять у межах SuperPoD через єдиний глобальний адресний простір. У такий спосіб розподілена пам’ять має працювати як спільний пул для моделей та проміжних даних, що не вміщуються в локальну пам’ять одного прискорювача. 18
За оцінкою Huawei, UnifiedBus підніме пропускну здатність інтерконекту з рівня приблизно 100 ГБ/с до рівня ТБ/с, а затримку в обидва боки — RTT — зменшить приблизно з 7 до 2 мікросекунд. Це цільові характеристики архітектури Huawei, а не загальне незалежне порівняння з конкуруючими платформами. 18
Atlas 960E SuperPoD поєднує майбутні процесори Ascend 960, UnifiedBus і оптичний модуль Hi-ONE з технологією near-packaged optics (NPO) — тобто оптикою, розміщеною близько до обчислювальних компонентів. Huawei називає повністю рідинно охолоджувану систему першим у галузі SuperPoD на базі NPO та позиціонує її для навчання й інференсу моделей до 10 трлн параметрів. 9
Заявлена максимальна конфігурація — 4 096 NPU з єдиною адресацією пам’яті, що забезпечують 8 EFLOPS у FP8 або 16 EFLOPS у FP4. 9
Оптика є центральною частиною проєкту, адже електричні з’єднання дедалі складніше масштабувати зі зростанням пропускної здатності та розміру кластера. Huawei заявляє, що один оптичний модуль Hi-ONE забезпечує 7,2 Тбіт/с. У проєктній системі на 4 096 NPU приблизно 5 500 модулів Hi-ONE мають замінити близько 48 000 звичайних оптичних модулів 800G. За прогнозом компанії, це зменшить споживання енергії більш ніж на 550 кВт і підвищить доступність системи до 99,8%. Це саме прогнозні показники Huawei для її конструкції. 9
Huawei також описала компоненти для різних фізичних рівнів кластера:
Для організацій, яким не потрібен величезний SuperPoD, Huawei пропонує Atlas 650E — меншу конфігурацію з 16 NPU у повнозв’язній мережі на UnifiedBus Link 2.0. Виробник заявляє до 4,0 ТБ/с пропускної здатності читання й запису вбудованої пам’яті та 13,4 ТБ/с пропускної здатності UB Link на 16-NPU сервер. 20
Huawei каже, що розробка Ascend 960 перевершила внутрішні очікування, а запланована продуктивність подвоїлася. Водночас компанія не оприлюднила деталей незалежних тестів, достатніх для перевірки цієї заяви. 11
Оголошений графік такий:
Компанія також повідомляла, що системи попереднього покоління Atlas 950 SuperPoD уже використовують у великих комерційних розгортаннях. Це не слід плутати з постачанням Atlas 960E: ця система прив’язана до майбутнього покоління Ascend 960. 3
9
UnifiedBus варто сприймати як системну відповідь Huawei на ту саму базову проблему, для якої створено Nvidia NVLink: як швидко обмінюватися даними між численними прискорювачами, щоб зі збільшенням кластера зростала корисна обчислювальна робота, а не накладні витрати на синхронізацію.
Huawei називає своїми відмінностями ширше об’єднання протоколів, глобальну адресацію пам’яті всередині SuperPoD, прямий доступ між різнорідними компонентами та інтеграцію NPO на рівні SuperPoD. 18
9
Проте наявні матеріали не дають підстав для прямого порівняння UnifiedBus і NVLink за пропускною здатністю, затримками, зрілістю програмного забезпечення, надійністю, вартістю чи реальною швидкістю навчання моделей. Так само вони не показують, що UnifiedBus є відкритим міжвиробничим стандартом із моделлю управління та цілями сумісності, подібними до відкритих ініціатив у сфері прискорювальних інтерконектів. UnifiedBus представлено як власну архітектуру й екосистему Huawei. 18
У заяві Huawei важливо те, що в центр ШІ-стратегії поставлено не тільки окремий чип, а й дизайн усієї системи: інтерконект, оптику, топологію та модель роботи з пам’яттю. Це може бути суттєвою перевагою для задач, де обмеженням є не лише обчислення на одному чипі, а й комунікація та доступний обсяг пам’яті.
Остаточні висновки можна буде робити після постачання Ascend 960 та Atlas 960E: знадобляться вимірювання пропускної здатності навчання й завантаження прискорювачів на реальних задачах, зрілий програмний інструментарій, дані про надійність у великому масштабі та здатність виробляти системи у значних обсягах. До того часу SuperPoD на 4 096 NPU та SuperCluster на мільйон NPU залишаються амбітними архітектурними цілями, а не незалежно продемонстрованими результатами. 9
11
18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Huawei заявляє, що Atlas 960E зможе об’єднати 4 096 NPU в єдиному просторі адресації пам’яті та забезпечити 8 EFLOPS у FP8 або 16 EFLOPS у FP4.
Huawei заявляє, що Atlas 960E зможе об’єднати 4 096 NPU в єдиному просторі адресації пам’яті та забезпечити 8 EFLOPS у FP8 або 16 EFLOPS у FP4. UnifiedBus має звести понад 10 протоколів з’єднання до однієї моделі пам’яті, щоб CPU, NPU, накопичувачі та пам’ять могли напряму обмінюватися даними.
Ascend 960DT Huawei планує випустити у I кварталі 2027 року, а Ascend 960PR — у III кварталі 2027 року; обидва терміни перенесено вперед.