Huawei menyatakan Atlas 960E boleh menskalakan pengalamatan memori bersatu kepada 4,096 NPU, dengan tuntutan 8 EFLOPS FP8 atau 16 EFLOPS FP4 bagi setiap SuperPoD. UnifiedBus menggabungkan lebih 10 protokol interkoneksi di bawah satu fabrik dengan semantik memori yang sama.
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How is Huawei’s new AI computing architecture—centered on the near-packaged-optics Atlas 960E SuperPoD, Ascend 960 chips, and UnifiedBus int. Article summary: Huawei’s approach is to treat communication and memory access—not just accelerator throughput—as the limiting resource in giant AI clusters. It combines tightly coupled Ascend NPUs, a single UnifiedBus protocol and memor. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Huawei mempertaruhkan bahawa dalam latihan AI pada skala sangat besar, masalah utama bukan semata-mata kuasa pengiraan cip pemecut. Sebaliknya, ribuan pemproses boleh banyak menunggu ketika parameter model, pengaktifan, cache dan capaian memori dipindahkan antara pelayan.
Atlas 960E SuperPoD, pelan cip Ascend 960 dan fabrik interkoneksi UnifiedBus ialah jawapan yang dicadangkan Huawei. Namun, angka prestasi dan kecekapan yang dibentangkan ialah tuntutan produk Huawei, bukannya penanda aras bebas yang telah disahkan. 9
18
Dalam kluster besar biasa, CPU, pemecut AI, storan dan memori lazimnya kekal sebagai sumber berasingan yang dihubungkan menggunakan pelbagai protokol. Huawei menyatakan UnifiedBus menyatukan lebih daripada 10 protokol interkoneksi di bawah satu protokol serta semantik memori, bagi membolehkan akses rakan setara secara terus antara CPU, NPU, memori dan pemacu keadaan pepejal (SSD). 18
Matlamat praktikalnya adalah mengurangkan masa menunggu. Perisian boleh mengalamati memori merentas SuperPoD melalui ruang alamat memori global yang bersatu, tanpa perlu berulang kali menyalin atau menyelaras data secara eksplisit antara nod yang terasing. Ini sepatutnya menjadikan memori teragih lebih mudah digunakan sebagai sumber terkumpul, khususnya apabila model dan data perantara melebihi memori setempat sebuah pemecut. 18
Huawei mendakwa seni bina UnifiedBus ini meningkatkan keupayaan interkoneksi daripada sekitar kelas 100 GB/s kepada kelas TB/s, sambil mengurangkan kependaman perjalanan pergi balik daripada kira-kira 7 mikro saat kepada 2 mikro saat. Angka itu merujuk kepada seni bina yang dicadangkan Huawei, dan bukan perbandingan umum yang diuji secara bebas dengan sistem pesaing. 18
Atlas 960E SuperPoD menggabungkan pemproses Ascend 960 yang akan datang, UnifiedBus dan enjin optik berhampiran pakej (near-packaged optics, NPO) Hi-ONE milik Huawei. Huawei menggambarkan sistem yang disejukkan cecair sepenuhnya ini sebagai SuperPoD berasaskan NPO untuk latihan dan inferens model sehingga 10 trilion parameter. 9
Konfigurasi utama yang dinyatakan ialah 4,096 NPU dengan pengalamatan memori bersatu, dengan penarafan 8 EFLOPS pada FP8 atau 16 EFLOPS pada FP4. 9
NPO menjadi elemen penting kerana sambungan elektrik semakin sukar diskalakan apabila jalur lebar dan saiz kluster meningkat. Huawei menyatakan setiap enjin optik Hi-ONE menawarkan 7.2 Tbit/s. Bagi sistem 4,096 NPU yang dicadangkan, syarikat itu berkata kira-kira 5,500 enjin Hi-ONE boleh menggantikan sekitar 48,000 modul optik 800G konvensional, mengurangkan penggunaan kuasa melebihi 550 kW serta meningkatkan ketersediaan kepada 99.8%. Semua ini ialah unjuran Huawei untuk reka bentuknya. 9
Huawei turut memperincikan produk bagi beberapa lapisan fizikal dalam kluster:
Bagi organisasi yang tidak memerlukan SuperPoD berskala besar, Atlas 650E menawarkan konfigurasi full-mesh 16 NPU yang lebih kecil berasaskan UnifiedBus Link 2.0. Huawei menyenaraikan sehingga 4.0 TB/s jalur lebar baca/tulis memori pada cip dan 13.4 TB/s jalur lebar UB Link bagi setiap pelayan 16 NPU. 20
Huawei berkata pembangunan Ascend 960 melepasi jangkaannya, dengan prestasi dirancang meningkat dua kali ganda. Namun, syarikat itu belum menerbitkan butiran penanda aras bebas yang diperlukan untuk mengesahkan kenyataan tersebut. 11
Jadual yang diumumkan adalah seperti berikut:
Huawei juga menyatakan sistem Atlas 950 SuperPoD—generasi terdahulu—sudah digunakan secara komersial pada skala besar. Kenyataan ini tidak sepatutnya disamakan dengan penggunaan perkakasan Atlas 960E, yang berkait dengan generasi Ascend 960 akan datang. 3
9
UnifiedBus paling mudah difahami sebagai respons Huawei di peringkat sistem terhadap masalah yang sama cuba diselesaikan oleh interkoneksi pemecut seperti Nvidia NVLink: memastikan banyak pemecut menerima data mencukupi dan boleh berkomunikasi cukup pantas supaya pertambahan skala menghasilkan pengiraan berguna, bukan lebih banyak beban penyelarasan.
Kelainan yang diketengahkan Huawei ialah penyatuan protokol yang lebih meluas, pengalamatan memori global dalam SuperPoD, akses terus merentas komponen heterogen dan penyepaduan NPO pada peringkat SuperPoD. 18
9
Namun, bahan yang tersedia tidak menyediakan perbandingan setara secara langsung dengan NVLink dari segi jalur lebar, kependaman, kematangan perisian, kebolehpercayaan, kos atau daya pemprosesan latihan sebenar. Ia juga tidak menunjukkan UnifiedBus sebagai standard terbuka merentas vendor yang setanding dari segi tadbir urus atau matlamat kesalingoperasian dengan inisiatif pautan pemecut terbuka. UnifiedBus dibentangkan sebagai seni bina dan ekosistem produk milik Huawei sendiri. 18
Pengumuman ini penting kerana Huawei meletakkan reka bentuk sistem—interkoneksi, optik, topologi dan semantik memori—di tengah strategi infrastruktur AInya. Pendekatan itu boleh memberi nilai strategik apabila beban kerja dihadkan oleh komunikasi dan kapasiti memori, bukan hanya pengiraan setiap cip.
Bukti muktamad hanya akan datang kemudian: penghantaran sistem Ascend 960 dan Atlas 960E, daya pemprosesan serta kadar penggunaan semasa latihan beban kerja sebenar, alat perisian yang boleh digunakan, kebolehpercayaan pada skala besar, dan keupayaan membekalkan sistem ini dalam jumlah besar. Buat masa ini, angka SuperPoD 4,096 NPU dan SuperCluster sejuta NPU ialah sasaran seni bina yang bercita-cita tinggi, bukan hasil yang telah ditunjukkan secara bebas. 9
11
18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Huawei menyatakan Atlas 960E boleh menskalakan pengalamatan memori bersatu kepada 4,096 NPU, dengan tuntutan 8 EFLOPS FP8 atau 16 EFLOPS FP4 bagi setiap SuperPoD.
Huawei menyatakan Atlas 960E boleh menskalakan pengalamatan memori bersatu kepada 4,096 NPU, dengan tuntutan 8 EFLOPS FP8 atau 16 EFLOPS FP4 bagi setiap SuperPoD. UnifiedBus menggabungkan lebih 10 protokol interkoneksi di bawah satu fabrik dengan semantik memori yang sama.
Ascend 960DT dijadualkan pada suku pertama 2027 dan Ascend 960PR pada suku ketiga 2027, masing masing lebih awal daripada pelan hala tuju Huawei sebelum ini.