Huawei oppgir at Atlas 960E kan knytte sammen 4 096 NPU er med felles minneadressering og levere 8 EFLOPS ved FP8 eller 16 EFLOPS ved FP4 per SuperPoD. UnifiedBus samler mer enn ti sammenkoblingsprotokoller i én felles protokoll og minnesemantikk, ifølge Huawei.
Publisert avRedigert med GPT-5.6 TerraBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How is Huawei’s new AI computing architecture—centered on the near-packaged-optics Atlas 960E SuperPoD, Ascend 960 chips, and UnifiedBus int. Article summary: Huawei’s approach is to treat communication and memory access—not just accelerator throughput—as the limiting resource in giant AI clusters. It combines tightly coupled Ascend NPUs, a single UnifiedBus protocol and memor. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Huaweis nye KI-infrastruktur bygger på en enkel idé: Når treningen skaleres til svært mange prosessorer, er det ikke nødvendigvis regnekraften i hver enkelt akselerator som er flaskehalsen. Det kan like gjerne være flyttingen av parametere, aktiveringer, hurtigbufferdata og minneaksesser mellom tusenvis av prosessorer. Atlas 960E SuperPoD, Ascend 960-veikartet og UnifiedBus er Huaweis foreslåtte løsning. Tallene for ytelse og effektivitet kommer fra Huawei selv og er ikke uavhengig verifiserte referansetester. 9
18
I store, tradisjonelle klynger behandles ofte CPU-er, akseleratorer, lagring og minne som adskilte ressurser som kommuniserer gjennom flere protokoller. Huawei sier at UnifiedBus samler mer enn ti sammenkoblingsprotokoller under én protokoll og én minnesemantikk. Det skal gi direkte node-til-node-tilgang mellom CPU-er, NPU-er, minne og SSD-er. 18
I praksis er hensikten å redusere ventetid. I stedet for gjentatte kopieringer eller eksplisitt koordinering av data mellom isolerte noder, skal programvare kunne adressere minne på tvers av en SuperPoD gjennom ett globalt adresseområde. Det er ment å gjøre distribuert minne enklere å bruke som en felles ressurs når modeller og mellomdata er større enn det lokale minnet i én akselerator. 18
Huawei hevder at arkitekturen løfter kapasiteten i sammenkoblingen fra omtrent 100 GB/s-nivået til TB/s-nivået, og reduserer rundturstiden fra rundt 7 mikrosekunder til 2 mikrosekunder. Dette er mål for Huaweis planlagte UnifiedBus-arkitektur, ikke en generell og uavhengig test mot konkurrentenes løsninger. 18
Atlas 960E SuperPoD kombinerer kommende Ascend 960-prosessorer med UnifiedBus og Huaweis Hi-ONE-motor for near-packaged optics (NPO). Huawei beskriver det væskekjølte systemet som en NPO-basert SuperPoD for trening og inferens med modeller på opptil 10 billioner parametere. 9
Den oppgitte toppkonfigurasjonen er 4 096 NPU-er med felles minneadressering, med en påstått ytelse på 8 EFLOPS ved FP8 eller 16 EFLOPS ved FP4. 9
NPO er sentralt i konstruksjonen fordi elektriske forbindelser blir vanskeligere å skalere når både båndbredde og klyngestørrelse vokser. Huawei oppgir 7,2 Tbit/s per Hi-ONE optisk motor. I det foreslåtte systemet med 4 096 NPU-er sier selskapet at rundt 5 500 Hi-ONE-motorer kan erstatte omtrent 48 000 konvensjonelle 800G-optiske moduler. Ifølge Huawei kan dette redusere strømforbruket med mer enn 550 kW og øke tilgjengeligheten til 99,8 prosent. Også dette er Huaweis egne anslag. 9
Huawei har også presentert komponenter for ulike nivåer i infrastrukturen:
For virksomheter som ikke trenger en enorm SuperPoD, er Atlas 650E en mindre løsning med 16 NPU-er i fullmesh, basert på UnifiedBus Link 2.0. Huawei oppgir opptil 4,0 TB/s lese- og skrivebåndbredde for minnet på brikken og 13,4 TB/s UB Link-båndbredde per server med 16 NPU-er. 20
Huawei sier utviklingen av Ascend 960 har overgått forventningene og at planlagt ytelse er doblet. Selskapet har imidlertid ikke publisert detaljene fra uavhengige referansetester som trengs for å etterprøve påstanden. 11
Det annonserte tidsskjemaet er:
Huawei har også sagt at systemer i den tidligere Atlas 950 SuperPod-generasjonen allerede er i storskala kommersiell bruk. Det må ikke forveksles med utplassering av Atlas 960E-maskinvare, som hører til den kommende Ascend 960-generasjonen. 3
9
UnifiedBus kan best forstås som Huaweis systemorienterte svar på det samme overordnede problemet som akseleratorkoblinger som Nvidia NVLink forsøker å løse: å holde mange akseleratorer kontinuerlig forsynt med data og la dem kommunisere raskt nok til at skalering gir nyttig regnekraft, fremfor økt synkroniseringsarbeid.
Huaweis uttalte særtrekk er en bredere samling av protokoller, global minneadressering i en SuperPoD, direkte tilgang mellom ulike typer komponenter og integrasjon av NPO på SuperPoD-nivå. 18
9
Det tilgjengelige materialet gir derimot ikke grunnlag for en direkte sammenligning med NVLink på båndbredde, forsinkelse, programvaremodenhet, driftssikkerhet, kostnad eller faktisk treningsgjennomstrømning. Det viser heller ikke at UnifiedBus er en åpen standard på tvers av leverandører, med tilsvarende styringsmodell eller interoperabilitetsmål som åpne initiativer for akseleratorforbindelser. UnifiedBus presenteres som Huaweis egen arkitektur og produktportefølje. 18
Annonseringen er viktig fordi Huawei setter systemdesign – sammenkobling, optikk, topologi og minnesemantikk – i sentrum for KI-strategien. Det kan være strategisk verdifullt når en arbeidslast begrenses like mye av kommunikasjon og minnekapasitet som av regnekraft per brikke.
Det avgjørende beviset kommer senere: leverte Ascend 960- og Atlas 960E-systemer, målbar treningsgjennomstrømning og utnyttelse i reelle arbeidslaster, brukbare programvareverktøy, driftssikkerhet i stor skala og evne til å levere systemene i volum. Inntil da er tallene for en SuperPoD med 4 096 NPU-er og en SuperCluster med én million NPU-er ambisiøse arkitekturmål, ikke uavhengig påviste resultater. 9
11
18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Huawei oppgir at Atlas 960E kan knytte sammen 4 096 NPU er med felles minneadressering og levere 8 EFLOPS ved FP8 eller 16 EFLOPS ved FP4 per SuperPoD.
Huawei oppgir at Atlas 960E kan knytte sammen 4 096 NPU er med felles minneadressering og levere 8 EFLOPS ved FP8 eller 16 EFLOPS ved FP4 per SuperPoD. UnifiedBus samler mer enn ti sammenkoblingsprotokoller i én felles protokoll og minnesemantikk, ifølge Huawei.
Ascend 960DT er planlagt for første kvartal 2027, mens Ascend 960PR er planlagt for tredje kvartal 2027 – begge tidligere enn Huaweis forrige veikart.