Huawei stelt dat de Atlas 960E binnen één SuperPoD 4.096 NPU's met uniforme geheugenadressering kan koppelen, goed voor 8 EFLOPS FP8 of 16 EFLOPS FP4. UnifiedBus brengt volgens Huawei meer dan tien interconnectprotocollen samen in één fabric met gedeelde geheugenbetekenis.
Gepubliceerd doorBewerkt met GPT-5.6 TerraAfbeeldingen gegenereerd met GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How is Huawei’s new AI computing architecture—centered on the near-packaged-optics Atlas 960E SuperPoD, Ascend 960 chips, and UnifiedBus int. Article summary: Huawei’s approach is to treat communication and memory access—not just accelerator throughput—as the limiting resource in giant AI clusters. It combines tightly coupled Ascend NPUs, a single UnifiedBus protocol and memor. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Huawei's nieuwe AI-infrastructuur vertrekt van een eenvoudig uitgangspunt: bij AI-training op zeer grote schaal is niet alleen de rekensnelheid van de versnellers bepalend. Het verplaatsen van parameters, activaties, caches en geheugentoegangen tussen duizenden processors kan minstens zo veel vertraging veroorzaken. Met de Atlas 960E SuperPoD, de geplande Ascend 960-processors en de UnifiedBus-interconnect wil Huawei juist dat knelpunt aanpakken. De prestaties en efficiëntiecijfers zijn claims van Huawei zelf en geen onafhankelijk geverifieerde benchmarks. 9
18
In een traditioneel groot cluster zijn cpu's, AI-versnellers, opslag en geheugen vaak afzonderlijke middelen die via verschillende protocollen communiceren. UnifiedBus voegt volgens Huawei meer dan tien interconnectprotocollen samen onder één protocol en één geheugenmodel. Daardoor moeten cpu's, NPU's, geheugen en SSD's rechtstreeks peer-to-peer toegang tot elkaar kunnen krijgen. 18
Het praktische doel is minder wachttijd. In plaats van gegevens steeds te kopiëren of expliciet te coördineren tussen geïsoleerde nodes, kan software geheugen binnen een SuperPoD via één globale adresruimte benaderen. Daarmee wil Huawei verdeeld geheugen bruikbaarder maken als gedeelde pool voor modellen en tussentijdse data die niet in het lokale geheugen van één versneller passen. 18
Huawei claimt dat de interconnectcapaciteit daarmee verschuift van ongeveer de 100-GB/s-klasse naar de TB/s-klasse. De round-trip-latency zou dalen van circa 7 microseconden naar 2 microseconden. Dit zijn doelwaarden voor Huawei's UnifiedBus-architectuur, geen algemene en onafhankelijk geteste vergelijking met concurrerende systemen. 18
De Atlas 960E SuperPoD combineert de komende Ascend 960-processors met UnifiedBus en Huawei's Hi-ONE-engine voor near-packaged optics (NPO). Daarbij worden optische verbindingen dicht bij de chipverpakking geïntegreerd. Huawei omschrijft het volledig vloeistofgekoelde systeem als een NPO-gebaseerde SuperPoD voor training en inferentie van modellen met maximaal 10 biljoen parameters. 9
De aangekondigde topconfiguratie omvat 4.096 NPU's met uniforme geheugenadressering en zou 8 EFLOPS bij FP8 of 16 EFLOPS bij FP4 leveren. 9
NPO is belangrijk in dit ontwerp omdat elektrische verbindingen steeds lastiger opschalen bij hogere bandbreedtes en grotere clusters. Volgens Huawei levert elke Hi-ONE-optische engine 7,2 Tbit/s. In het voorgestelde systeem met 4.096 NPU's zouden circa 5.500 Hi-ONE-engines ongeveer 48.000 conventionele optische 800G-modules vervangen. Dat zou het stroomverbruik met meer dan 550 kW verlagen en de beschikbaarheid op 99,8% brengen. Het gaat om Huawei-projecties voor deze architectuur. 9
Huawei positioneert daarnaast producten voor verschillende fysieke lagen van een cluster:
Voor organisaties die geen enorme SuperPoD nodig hebben, is er de Atlas 650E: een kleinere configuratie met 16 NPU's in een full-mesh-netwerk op basis van UnifiedBus Link 2.0. Huawei vermeldt maximaal 4,0 TB/s lees- en schrijbandbreedte voor on-chipgeheugen en 13,4 TB/s UB Link-bandbreedte per server met 16 NPU's. 20
Huawei zegt dat de ontwikkeling van Ascend 960 sneller gaat dan verwacht en dat de geplande prestaties zijn verdubbeld. Het bedrijf heeft echter geen onafhankelijke benchmarkdetails gepubliceerd waarmee die uitspraak kan worden gecontroleerd. 11
De aangekondigde planning:
Huawei heeft ook gemeld dat systemen van de eerdere Atlas 950 SuperPod-generatie al op grote commerciële schaal worden gebruikt. Dat mag niet worden verward met de inzet van Atlas 960E-hardware, die gekoppeld is aan de toekomstige Ascend 960-generatie. 3
9
UnifiedBus is vooral te zien als Huawei's antwoord op hetzelfde fundamentele probleem waarvoor ook acceleratorinterconnects zoals Nvidia NVLink zijn ontworpen: veel AI-versnellers snel genoeg van data voorzien en onderling snel laten communiceren, zodat opschalen tot nuttige rekenkracht leidt in plaats van meer synchronisatieverlies.
Huawei onderscheidt zich naar eigen zeggen met een bredere protocolintegratie, globale geheugenadressering binnen een SuperPoD, directe toegang tussen verschillende soorten componenten en NPO-integratie op SuperPoD-niveau. 18
9
Het beschikbare materiaal onderbouwt echter geen eerlijke één-op-éénvergelijking met NVLink op bandbreedte, latency, softwarevolwassenheid, betrouwbaarheid, kosten of daadwerkelijke trainingsdoorvoer. Evenmin blijkt hieruit dat UnifiedBus een open standaard voor meerdere leveranciers is, met vergelijkbare afspraken over bestuur en interoperabiliteit als open initiatieven voor acceleratorverbindingen. UnifiedBus wordt gepresenteerd als Huawei's eigen architectuur en productecosysteem. 18
De aankondiging is vooral relevant omdat Huawei systeemontwerp — interconnects, optica, topologie en geheugenmodel — centraal zet in zijn AI-infrastructuurstrategie. Dat kan waardevol zijn bij workloads waar communicatie en geheugencapaciteit even beperkend zijn als de rekenkracht per chip.
Het doorslaggevende bewijs moet nog volgen: leveringen van Ascend 960- en Atlas 960E-systemen, meetbare trainingsdoorvoer en bezettingsgraad bij echte workloads, bruikbare softwaretools, betrouwbaarheid op schaal en de mogelijkheid om deze systemen in grote volumes te produceren. Tot die tijd zijn de SuperPoD met 4.096 NPU's en de SuperCluster met één miljoen NPU's ambitieuze architectuurdoelen, geen onafhankelijk aangetoonde resultaten. 9
11
18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Huawei stelt dat de Atlas 960E binnen één SuperPoD 4.096 NPU's met uniforme geheugenadressering kan koppelen, goed voor 8 EFLOPS FP8 of 16 EFLOPS FP4.
Huawei stelt dat de Atlas 960E binnen één SuperPoD 4.096 NPU's met uniforme geheugenadressering kan koppelen, goed voor 8 EFLOPS FP8 of 16 EFLOPS FP4. UnifiedBus brengt volgens Huawei meer dan tien interconnectprotocollen samen in één fabric met gedeelde geheugenbetekenis.
De Ascend 960DT staat gepland voor het eerste kwartaal van 2027 en de Ascend 960PR voor het derde kwartaal van 2027; beide liggen vóór Huawei's eerdere planning.