Huawei, Atlas 960E SuperPoD’un birleşik bellek adreslemesiyle 4.096 NPU’ya ölçekleneceğini; sistem başına FP8’de 8 EFLOPS veya FP4’te 16 EFLOPS sağlayacağını öne sürüyor. UnifiedBus, 10’dan fazla bağlantı protokolünü tek bir protokol ve bellek semantiğinde birleştirmeyi amaçlıyor.
YayımlayanGPT-5.6 Terra ile düzenlendiGörseller GPT Image 2 ile oluşturuldu
Research answer

Create a landscape editorial hero image for this Studio Global article: How is Huawei’s new AI computing architecture—centered on the near-packaged-optics Atlas 960E SuperPoD, Ascend 960 chips, and UnifiedBus int. Article summary: Huawei’s approach is to treat communication and memory access—not just accelerator throughput—as the limiting resource in giant AI clusters. It combines tightly coupled Ascend NPUs, a single UnifiedBus protocol and memor. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Huawei’nin yeni yapay zekâ altyapısı tek bir varsayıma dayanıyor: Çok büyük ölçekli model eğitiminde verimliliği sınırlayan unsur, yalnızca hızlandırıcıların ham hesaplama gücü olmayabilir. Parametrelerin, ara aktivasyonların, önbelleklerin ve bellek erişimlerinin binlerce işlemci arasında taşınması da kritik bir darboğaz hâline gelir. Atlas 960E SuperPoD, Ascend 960 yol haritası ve UnifiedBus, Huawei’nin bu soruna verdiği yanıt olarak konumlanıyor. Ancak şirketin performans ve verimlilik rakamları ürün iddialarıdır; bağımsız testlerle doğrulanmış kıyaslamalar olarak görülmemelidir. 9
18
Geleneksel büyük kümelerde CPU’lar, hızlandırıcılar, depolama ve bellek çoğu zaman birden fazla protokolle bağlanan ayrı kaynaklar olarak ele alınır. Huawei, UnifiedBus’ın 10’dan fazla bağlantı protokolünü tek bir protokol ve bellek semantiği altında birleştirdiğini; CPU, NPU, bellek ve SSD’ler arasında doğrudan eşler arası erişim sağladığını söylüyor. 18
Pratikte amaç, sistemin bekleme süresini azaltmak. Yazılımın izole düğümler arasında veriyi tekrar tekrar kopyalaması veya açıkça senkronize etmesi yerine, SuperPoD içindeki belleğe ortak bir küresel adres alanı üzerinden erişmesi hedefleniyor. Böylece bir hızlandırıcının yerel belleğine sığmayan büyük modeller ve ara veriler için dağıtık bellek, daha kullanılabilir ortak bir kaynak hâline gelebilir. 18
Huawei’ye göre mimari, bağlantı kapasitesini yaklaşık 100 GB/s düzeyinden TB/s sınıfına çıkarıyor; gidiş-dönüş gecikmesini de yaklaşık 7 mikrosaniyeden 2 mikrosaniyeye indiriyor. Bunlar, Huawei’nin hedeflediği UnifiedBus tasarımına ilişkin rakamlardır; rakip sistemlerle bağımsız ve eşdeğer koşullarda yapılmış genel bir karşılaştırma değildir. 18
Atlas 960E SuperPoD, gelecek nesil Ascend 960 işlemcileri; UnifiedBus’ı ve Huawei’nin Hi-ONE yakın paketli optik (NPO) motorunu bir araya getiriyor. Huawei, tamamen sıvı soğutmalı bu sistemi, 10 trilyona kadar parametreye sahip modellerde eğitim ve çıkarım işlemleri için tasarlanmış NPO tabanlı bir SuperPoD olarak tanımlıyor. 9
Açıklanan en yüksek yapılandırma, birleşik bellek adreslemesine sahip 4.096 NPU içeriyor. Huawei bu yapılandırma için FP8’de 8 EFLOPS, FP4’te ise 16 EFLOPS performans iddiasında bulunuyor. 9
Yakın paketli optik, bant genişliği ve küme ölçeği büyüdükçe elektriksel bağlantıların ölçeklenmesinin zorlaşması nedeniyle tasarımın merkezinde yer alıyor. Huawei, her Hi-ONE optik motorunun 7,2 Tbit/s sağladığını belirtiyor. Şirketin öngörüsüne göre 4.096 NPU’lu sistemde yaklaşık 5.500 Hi-ONE motoru, yaklaşık 48.000 geleneksel 800G optik modülün yerini alabilecek; bu da 550 kW’ın üzerinde güç tasarrufu ve %99,8 kullanılabilirlik sağlayabilecek. Bunlar Huawei’nin kendi tasarımı için açıkladığı projeksiyonlardır. 9
Huawei, kümenin fiziksel katmanlarına göre farklı ürünler de tanımlıyor:
Dev bir SuperPoD’a ihtiyaç duymayan kuruluşlar içinse Atlas 650E daha küçük bir seçenek olarak sunuluyor. UnifiedBus Link 2.0 tabanlı 16 NPU’lu tam ağ (full-mesh) yapılandırmasında, çip üzeri bellek için 4,0 TB/s’ye kadar okuma-yazma bant genişliği ve 16 NPU’lu sunucu başına 13,4 TB/s UB Link bant genişliği listeleniyor. 20
Huawei, Ascend 960 geliştirme sürecinin şirket beklentilerini aştığını ve planlanan performansın iki katına çıktığını belirtiyor. Ancak bu beyanı doğrulayacak ayrıntılı, bağımsız kıyaslama sonuçları kamuya açıklanmış değil. 11
Açıklanan takvim şöyle:
Huawei ayrıca önceki nesil Atlas 950 SuperPoD sistemlerinin büyük ölçekli ticari kullanımda olduğunu söyledi. Bu açıklama, yaklaşan Ascend 960 nesline bağlı Atlas 960E donanımının hâlihazırda sahada olduğu anlamına gelmiyor. 3
9
UnifiedBus, özünde Nvidia NVLink gibi hızlandırıcı ara bağlantılarının çözmeye çalıştığı aynı genel probleme Huawei’nin sistem düzeyinde geliştirdiği bir yanıt: Çok sayıda hızlandırıcının veriye yeterince hızlı erişmesini ve birbirleriyle hızlı iletişim kurmasını sağlamak; böylece ölçek büyüdükçe hesaplama kazancının senkronizasyon yükü nedeniyle erimemesini hedeflemek.
Huawei’nin öne çıkardığı farklar; daha geniş protokol birleştirmesi, SuperPoD içindeki küresel bellek adreslemesi, farklı donanım bileşenleri arasında doğrudan erişim ve NPO’nun SuperPoD düzeyinde mimariye dâhil edilmesi. 18
9
Bununla birlikte mevcut bilgiler, UnifiedBus ile NVLink arasında bant genişliği, gecikme, yazılım ekosisteminin olgunluğu, güvenilirlik, maliyet veya gerçek eğitim verimi bakımından doğrudan ve adil bir karşılaştırma kurmaya yetmiyor. Ayrıca UnifiedBus, açık hızlandırıcı bağlantı girişimlerinin yönetişim ya da çok üreticili birlikte çalışabilirlik hedefleriyle kıyaslanabilecek açık bir standart olarak sunulmuyor. Huawei bunu kendi mimarisi ve ürün ekosistemi olarak tanıtıyor. 18
Huawei’nin duyurusu, yapay zekâ altyapısı stratejisinde işlemcinin yanı sıra ara bağlantıyı, optiği, ağ topolojisini ve bellek semantiğini merkeze koyması bakımından önemli. Bir iş yükü, tek tek çiplerin hesaplama kapasitesi kadar veri iletişimi ve bellek kapasitesiyle de sınırlanıyorsa bu yaklaşım stratejik bir avantaj sağlayabilir.
Belirleyici kanıtlar daha sonra ortaya çıkacak: Ascend 960 ve Atlas 960E sistemlerinin sevkiyatı, gerçek iş yüklerinde ölçülebilir eğitim verimi ve kullanım oranı, kullanılabilir yazılım araçları, büyük ölçekte güvenilirlik ve bu sistemlerin yüksek hacimde tedarik edilebilmesi. O zamana kadar 4.096 NPU’lu SuperPoD ve milyon-NPU’lu SuperCluster rakamları, bağımsız biçimde gösterilmiş sonuçlardan çok iddialı mimari hedefler olarak değerlendirilmelidir. 9
11
18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Huawei, Atlas 960E SuperPoD’un birleşik bellek adreslemesiyle 4.096 NPU’ya ölçekleneceğini; sistem başına FP8’de 8 EFLOPS veya FP4’te 16 EFLOPS sağlayacağını öne sürüyor.
Huawei, Atlas 960E SuperPoD’un birleşik bellek adreslemesiyle 4.096 NPU’ya ölçekleneceğini; sistem başına FP8’de 8 EFLOPS veya FP4’te 16 EFLOPS sağlayacağını öne sürüyor. UnifiedBus, 10’dan fazla bağlantı protokolünü tek bir protokol ve bellek semantiğinde birleştirmeyi amaçlıyor.
Ascend 960DT’nin 2027’nin ilk çeyreğinde, Ascend 960PR’nin ise 2027’nin üçüncü çeyreğinde piyasaya çıkması planlanıyor; iki tarih de Huawei’nin önceki yol haritasından daha erken.