Huawei mengklaim Atlas 960E dapat menyatukan pengalamatan memori di 4.096 NPU, dengan performa 8 EFLOPS FP8 atau 16 EFLOPS FP4 per SuperPoD. UnifiedBus menggabungkan lebih dari 10 protokol interkoneksi dalam satu fabric dengan semantik memori terpadu.
Diterbitkan olehDiedit dengan GPT-5.6 TerraGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: How is Huawei’s new AI computing architecture—centered on the near-packaged-optics Atlas 960E SuperPoD, Ascend 960 chips, and UnifiedBus int. Article summary: Huawei’s approach is to treat communication and memory access—not just accelerator throughput—as the limiting resource in giant AI clusters. It combines tightly coupled Ascend NPUs, a single UnifiedBus protocol and memor. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Pada klaster AI yang sangat besar, kendala utamanya tidak selalu terletak pada kemampuan hitung chip akselerator. Memindahkan parameter model, aktivasi, cache, dan akses memori di antara ribuan prosesor dapat membuat perangkat keras lebih sering menunggu data daripada menghitung. Atlas 960E SuperPoD, roadmap Ascend 960, dan fabric UnifiedBus adalah jawaban Huawei untuk masalah tersebut. Namun, seluruh angka performa dan efisiensi di bawah ini merupakan klaim produk Huawei, bukan hasil benchmark independen. 9
18
Pada klaster besar konvensional, CPU, akselerator, penyimpanan, dan memori kerap menjadi sumber daya terpisah yang dihubungkan oleh beberapa protokol. Huawei menyatakan UnifiedBus menyatukan lebih dari 10 protokol interkoneksi dalam satu protokol dan semantik memori, sehingga CPU, NPU, memori, serta SSD dapat saling mengakses secara langsung antarpiranti (peer-to-peer). 18
Tujuan praktisnya adalah mengurangi waktu tunggu. Alih-alih perangkat lunak harus berulang kali menyalin atau mengoordinasikan data secara eksplisit antar-node yang terisolasi, memori di seluruh SuperPoD dapat dialamatkan melalui satu ruang alamat memori global. Pendekatan ini dirancang agar memori terdistribusi dapat dipakai seperti sumber daya bersama, terutama ketika model dan data antara melampaui memori lokal satu akselerator. 18
Huawei mengklaim fabric tersebut meningkatkan kemampuan interkoneksi dari kisaran 100 GB/detik ke kelas TB/detik, sekaligus memangkas latensi pulang-pergi dari sekitar 7 mikrodetik menjadi 2 mikrodetik. Angka ini menggambarkan rancangan UnifiedBus yang dituju Huawei, bukan perbandingan umum yang telah diuji secara independen terhadap sistem pesaing. 18
Atlas 960E SuperPoD memadukan prosesor Ascend 960 yang akan datang, UnifiedBus, dan mesin near-packaged optics (NPO) Hi-ONE milik Huawei. Huawei menggambarkan sistem berpendingin cair penuh ini sebagai SuperPoD berbasis NPO untuk pelatihan dan inferensi model hingga 10 triliun parameter. 9
Konfigurasi unggulannya disebut mencakup 4.096 NPU dengan pengalamatan memori terpadu, dengan klaim 8 EFLOPS pada FP8 atau 16 EFLOPS pada FP4. 9
NPO menjadi bagian penting karena koneksi listrik semakin sulit ditingkatkan skalanya seiring kenaikan bandwidth dan ukuran klaster. Huawei menyatakan setiap mesin optik Hi-ONE menyediakan 7,2 Tbit/detik. Dalam rancangan sistem 4.096 NPU, sekitar 5.500 mesin Hi-ONE diklaim dapat menggantikan sekitar 48.000 modul optik 800G konvensional, mengurangi konsumsi daya lebih dari 550 kW, serta meningkatkan ketersediaan menjadi 99,8%. Semua itu adalah proyeksi Huawei untuk desainnya. 9
Huawei juga menyiapkan produk untuk beberapa tingkat fisik dalam klaster:
Bagi organisasi yang tidak membutuhkan SuperPoD masif, Atlas 650E menawarkan konfigurasi full-mesh 16 NPU yang lebih kecil berbasis UnifiedBus Link 2.0. Huawei mencantumkan bandwidth baca/tulis memori on-chip hingga 4,0 TB/detik dan bandwidth UB Link 13,4 TB/detik per server 16 NPU. 20
Huawei menyatakan pengembangan Ascend 960 melampaui ekspektasi perusahaan dan performa yang direncanakan telah berlipat dua. Namun, Huawei belum menerbitkan detail benchmark independen yang diperlukan untuk memverifikasi pernyataan tersebut. 11
Jadwal yang diumumkan adalah:
Huawei juga mengatakan sistem Atlas 950 SuperPod—generasi terdahulu—sudah digunakan secara komersial dalam skala besar. Pernyataan itu tidak boleh disamakan dengan penerapan perangkat keras Atlas 960E, yang terkait dengan generasi Ascend 960 mendatang. 3
9
UnifiedBus paling tepat dipahami sebagai jawaban Huawei pada tingkat sistem terhadap persoalan luas yang juga ditangani interkoneksi akselerator seperti Nvidia NVLink: menjaga banyak akselerator tetap memperoleh data dan berkomunikasi cukup cepat, sehingga penambahan skala menghasilkan komputasi yang benar-benar berguna, bukan sekadar tambahan beban sinkronisasi.
Pembeda yang diklaim Huawei ialah penyatuan protokol yang lebih luas, pengalamatan memori global di dalam SuperPoD, akses langsung lintas komponen heterogen, serta integrasi NPO pada tingkat SuperPoD. 18
9
Namun, materi yang tersedia belum membuktikan perbandingan setara dengan NVLink dalam hal bandwidth, latensi, kematangan perangkat lunak, keandalan, biaya, maupun throughput pelatihan nyata. Materi tersebut juga tidak menunjukkan UnifiedBus sebagai standar terbuka lintas vendor yang sebanding dari sisi tata kelola atau tujuan interoperabilitas dengan inisiatif interkoneksi akselerator terbuka. UnifiedBus dipresentasikan sebagai arsitektur dan ekosistem produk milik Huawei sendiri. 18
Pengumuman Huawei penting karena menempatkan desain sistem—interkoneksi, optik, topologi, dan semantik memori—di pusat strategi infrastruktur AI-nya. Pendekatan ini berpotensi bernilai ketika beban kerja dibatasi oleh komunikasi dan kapasitas memori, bukan hanya kemampuan komputasi per chip.
Uji penentunya baru akan datang kemudian: pengiriman sistem Ascend 960 dan Atlas 960E, throughput serta utilisasi pelatihan pada beban kerja nyata, perangkat lunak yang dapat digunakan, keandalan pada skala besar, dan kemampuan memasok sistem dalam volume tinggi. Sampai saat itu, angka SuperPoD 4.096 NPU dan SuperCluster satu juta NPU merupakan target arsitektural yang ambisius, bukan capaian yang telah dibuktikan secara independen. 9
11
18
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Huawei mengklaim Atlas 960E dapat menyatukan pengalamatan memori di 4.096 NPU, dengan performa 8 EFLOPS FP8 atau 16 EFLOPS FP4 per SuperPoD.
Huawei mengklaim Atlas 960E dapat menyatukan pengalamatan memori di 4.096 NPU, dengan performa 8 EFLOPS FP8 atau 16 EFLOPS FP4 per SuperPoD. UnifiedBus menggabungkan lebih dari 10 protokol interkoneksi dalam satu fabric dengan semantik memori terpadu.
Ascend 960DT dijadwalkan pada kuartal I 2027 dan Ascend 960PR pada kuartal III 2027, keduanya lebih cepat dari roadmap Huawei sebelumnya.