Huawei טוענת כי Atlas 960E יאפשר מיעון זיכרון אחיד על פני 4,096 יחידות NPU, עם יעד של 8 אקסה־פלופס ב FP8 או 16 אקסה־פלופס ב FP4 לכל SuperPoD. UnifiedBus מאחדת יותר מעשרה פרוטוקולי קישוריות תחת פרוטוקול וסמנטיקת זיכרון אחת, כדי לאפשר גישה ישירה יותר בין מעבדים, מאיצים, זיכרון ואחסון.
פורסם על ידינערך באמצעות GPT-5.6 Terraהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How is Huawei’s new AI computing architecture—centered on the near-packaged-optics Atlas 960E SuperPoD, Ascend 960 chips, and UnifiedBus int. Article summary: Huawei’s approach is to treat communication and memory access—not just accelerator throughput—as the limiting resource in giant AI clusters. It combines tightly coupled Ascend NPUs, a single UnifiedBus protocol and memor. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Huawei מציעה תפיסה פשוטה אך שאפתנית לתשתיות בינה מלאכותית: באשכולות ענק לא תמיד כוח החישוב של המאיץ הוא המגבלה העיקרית. לעיתים הבעיה היא הזמן שבו אלפי מעבדים ממתינים להעברת פרמטרים, אקטיבציות, מטמוני נתונים וגישה לזיכרון. Atlas 960E SuperPoD, מעבדי Ascend 960 ומערך הקישוריות UnifiedBus הם הניסיון של החברה לפתור את בעיית התקשורת הזאת מהיסוד.
חשוב לסייג: נתוני הביצועים, החיסכון באנרגיה והיקפי ההתרחבות המוצגים כאן הם טענות ותחזיות של Huawei, ולא תוצאות של מבחנים בלתי תלויים. 9
18
באשכולות AI גדולים, מעבדים כלליים (CPU), מאיצי AI מסוג NPU, זיכרון ואחסון נוטים לפעול כרכיבים נפרדים שמחוברים באמצעות כמה פרוטוקולים. לפי Huawei, UnifiedBus מאחדת יותר מעשרה פרוטוקולי קישוריות תחת פרוטוקול אחד וסמנטיקת זיכרון אחת, ומאפשרת גישת עמית־לעמית ישירה בין CPUs, NPUs, זיכרון וכונני SSD. 18
הרעיון המעשי הוא להפחית זמני המתנה והעתקות מידע. במקום שתוכנה תצטרך שוב ושוב להעביר נתונים או לתאם גישה בין צמתים מבודדים, היא אמורה להיות מסוגלת לפנות לזיכרון ברחבי ה-SuperPoD באמצעות מרחב כתובות זיכרון גלובלי ואחיד. כך, לפחות לפי התכנון, זיכרון מבוזר יוכל לשמש כמאגר משותף עבור מודלים ונתוני ביניים שגדולים מכדי להיכנס לזיכרון המקומי של מאיץ יחיד. 18
Huawei טוענת כי הארכיטקטורה מעלה את יכולת הקישוריות מסדר גודל של כ-100 גיגה־בייט לשנייה לסדר גודל של טרה־בייט לשנייה, ומקצרת את השהיית הלוך־ושוב מכ-7 מיקרו־שניות ל-2 מיקרו־שניות. אלה נתוני יעד של UnifiedBus, ולא השוואה כללית או בלתי תלויה למערכות מתחרות. 18
Atlas 960E SuperPoD משלב את מעבדי Ascend 960 העתידיים עם UnifiedBus ועם מנוע האופטיקה Hi-ONE של Huawei, המבוסס על NPO — אופטיקה קרובה למארז. Huawei מתארת את המערכת, המקוררת כולה בנוזל, כ-SuperPoD מבוסס NPO שנועד לאימון ולהסקה של מודלים בהיקף של עד 10 טריליון פרמטרים. 9
בתצורת הדגל המוצהרת, המערכת כוללת 4,096 יחידות NPU עם מיעון זיכרון אחיד, ומיועדת לספק 8 אקסה־פלופס ב-FP8 או 16 אקסה־פלופס ב-FP4. 9
אופטיקה קרובה למארז היא רכיב מרכזי בתכנון, משום שחיבורים חשמליים נעשים מורכבים יותר להרחבה ככל שרוחב הפס וגודל האשכול גדלים. Huawei טוענת שכל מנוע אופטי Hi-ONE מספק 7.2 טרה־ביט לשנייה. בתכנון של מערכת עם 4,096 יחידות NPU, החברה מעריכה שכ-5,500 מנועי Hi-ONE יחליפו כ-48,000 מודולים אופטיים רגילים מסוג 800G, יחסכו יותר מ-550 קילוואט ויעלו את הזמינות ל-99.8%. גם אלה תחזיות של Huawei עבור התכנון שלה. 9
Huawei מגדירה רכיבים שונים לרמות הפיזיות של האשכול:
לארגונים שאינם זקוקים ל-SuperPoD עצום, Huawei מציעה את Atlas 650E: תצורת full-mesh קטנה יותר עם 16 יחידות NPU, המבוססת על UnifiedBus Link 2.0. החברה מציינת רוחב פס של עד 4.0 טרה־בייט לשנייה לקריאה ולכתיבה בזיכרון על־שבבי, ורוחב פס UB Link של 13.4 טרה־בייט לשנייה לכל שרת בעל 16 NPUs. 20
Huawei מסרה שפיתוח Ascend 960 התקדם מעבר לציפיותיה, וכי הביצועים המתוכננים הוכפלו. עם זאת, החברה לא פרסמה פירוט של מבחנים בלתי תלויים שיאפשר לאמת את הטענה. 11
לוח הזמנים שהוכרז הוא:
Huawei מסרה גם שמערכות Atlas 950 SuperPod, מדור קודם, כבר נמצאות בשימוש מסחרי בקנה מידה גדול. אין לבלבל זאת עם פריסה של Atlas 960E, התלויה בדור Ascend 960 העתידי. 3
9
אפשר להבין את UnifiedBus כתשובת מערכת של Huawei לאותה בעיה רחבה שמטפל בה גם NVLink של Nvidia: כיצד להזין מאיצים רבים בנתונים ולאפשר להם לתקשר במהירות גבוהה מספיק, כך שהגדלת מספר השבבים תניב חישוב שימושי ולא בעיקר עומס סנכרון.
ההבדלים ש-Huawei מדגישה הם איחוד רחב יותר של פרוטוקולים, מיעון זיכרון גלובלי בתוך SuperPoD, גישה ישירה בין רכיבים הטרוגניים ושילוב NPO ברמת ה-SuperPoD. 18
9
אלא שהחומר הזמין אינו מאפשר השוואה ישירה מול NVLink ברוחב פס, השהיה, בשלות כלי התוכנה, אמינות, עלות או תפוקת אימון בפועל. הוא גם אינו מראה ש-UnifiedBus הוא תקן פתוח ורב־ספקי, במודל ממשלתי או ביעדי תאימות דומים ליוזמות קישוריות פתוחות למאיצים. UnifiedBus מוצגת כארכיטקטורה וכאקוסיסטם מוצרי של Huawei עצמה. 18
ההכרזה משמעותית משום שהיא מציבה את תכנון המערכת — קישוריות, אופטיקה, טופולוגיה וסמנטיקת זיכרון — במרכז אסטרטגיית ה-AI של Huawei. זו עשויה להיות גישה חשובה במיוחד במשימות שבהן התקשורת וקיבולת הזיכרון מגבילות את הביצועים לא פחות מכוח החישוב של כל שבב.
המבחן האמיתי יגיע בהמשך: אספקת מערכות Ascend 960 ו-Atlas 960E, מדידות תפוקה וניצול באימון משימות אמיתיות, כלי תוכנה שימושיים, אמינות בקנה מידה גדול ויכולת ייצור ואספקה בהיקף רחב. עד אז, נתוני ה-SuperPoD עם 4,096 יחידות NPU וה-SuperCluster עם מיליון NPUs הם יעדים ארכיטקטוניים שאפתניים — לא הישגים שהודגמו באופן בלתי תלוי. 9
11
18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Huawei טוענת כי Atlas 960E יאפשר מיעון זיכרון אחיד על פני 4,096 יחידות NPU, עם יעד של 8 אקסה־פלופס ב FP8 או 16 אקסה־פלופס ב FP4 לכל SuperPoD.
Huawei טוענת כי Atlas 960E יאפשר מיעון זיכרון אחיד על פני 4,096 יחידות NPU, עם יעד של 8 אקסה־פלופס ב FP8 או 16 אקסה־פלופס ב FP4 לכל SuperPoD. UnifiedBus מאחדת יותר מעשרה פרוטוקולי קישוריות תחת פרוטוקול וסמנטיקת זיכרון אחת, כדי לאפשר גישה ישירה יותר בין מעבדים, מאיצים, זיכרון ואחסון.
Ascend 960DT מיועד לרבעון הראשון של 2027 ו Ascend 960PR לרבעון השלישי של 2027 — שניהם מוקדמים ביחס למפת הדרכים הקודמת של החברה.