במקביל, Azure כבר נערכת לפריסת מערכות Vera Rubin NVL72 של Nvidia, כך שהאסטרטגיה של מיקרוסופט נשענת על שני ספקי חומרה מרכזיים ולא על ספק יחיד .
ההחלטה נועדה לצמצם סיכוני אספקה ולהימנע מתלות ארוכת טווח בפלטפורמה אחת . בעולם שבו הביקוש למאיצי AI עולה במהירות, עבודה עם AMD ועם Nvidia מעניקה למיקרוסופט גמישות תפעולית וכוח מיקוח גדול יותר — במיוחד אם אחד הספקים יתקשה לספק את הכמויות הנדרשות.
הגישה הזו מתאימה גם לקו המודל־אגנוסטי של מיקרוסופט ב־Azure וב־Copilot: החברה אינה רוצה לבסס את כל שירותי ה־AI שלה על ארכיטקטורה אחת בלבד . מנכ״ל מיקרוסופט, סאטיה נאדלה, אמר כי החברה תהיה בין ספקיות הענן הראשונות שיפרסו תשתיות AI מדור חדש המבוססות הן על AMD Helios והן על Nvidia Vera Rubin .
המחירים הרשמיים של שתי המערכות לא פורסמו. עם זאת, Futurum Group מעריכה כי העלות של מדף AMD Helios תעמוד על 5–5.5 מיליון דולר, לעומת 3.5–4 מיליון דולר עבור Nvidia Vera Rubin NVL72 . כלומר, Helios יקרה בכ־40% בהשוואה ישירה בין מדף למדף .
הפער מיוחס, בין היתר, לכמות הזיכרון הגדולה יותר של Helios, לארכיטקטורה המבוססת על תקנים פתוחים ולשילוב של מאיצים, מעבדים ורכיבי תקשורת מתוצרת AMD .
AMD טוענת שהמחיר הגבוה יותר עשוי להשתלם בעומסי עבודה של הסקת מסקנות. לפי נתוני המעבדה של החברה, Helios מציעה :
ליסה סו, מנכ״לית AMD, הציגה את הנתונים באירוע Advancing AI 2026 וטענה כי Helios מספקת לפחות 15% יותר ביצועים במודלים הגדולים ביותר, 50% יותר זיכרון HBM ועד 30% יותר טוקנים לדולר .
עם זאת, מדובר עדיין בהשוואה מטעם AMD, מול מערכת Vera Rubin שטרם נבחנה במלואה בפרודקשן. Futurum Group הזהירה כי טענות החברה ליתרון של 15% בביצועים ול־30% בכמות הטוקנים לדולר הן למעשה "חישובי ספק" מול מוצר שטרם נשלח, וייבחנו בתנאי ייצור במהלך שני הרבעונים הקרובים .
Helios היא מערכת AI משולבת בקנה מידה של מדף, מקוררת בנוזל. בניגוד לשרת רגיל שמכיל מספר מאיצים, מדובר ביחידת מחשוב שלמה שבה המאיצים, המעבדים ורכיבי הרשת מתוכננים לעבוד יחד .
| רכיב | מפרט |
|---|---|
| מאיצים | 72 מאיצי AMD Instinct MI455X |
| ארכיטקטורת GPU | CDNA 5, על גבי שבבי Chiplet בתהליכי 2 ו־3 ננומטר של TSMC |
| מספר טרנזיסטורים במאיץ | 320 מיליארד |
| מעבדים | 18 מעבדי AMD EPYC Venice מדור שישי — אחד בכל מגש מחשוב |
| רשת | כרטיסי AMD Pensando Vulcano 800 AI NIC, עם Ethernet במהירות 800 גיגה־ביט לשנייה ועד 2.4 טרה־ביט לשנייה לכל GPU בתקשורת בין מדפים |
| חיבור בין המאיצים | UALink, המועבר על גבי Ethernet |
| חיבור בין מדפים | תקנים התואמים ל־Ultra Ethernet Consortium |
| זיכרון כולל | עד 31 טרה־בייט HBM4 בכל מדף |
| זיכרון לכל GPU | 432 גיגה־בייט, באמצעות 12 ערימות HBM4 של 36 גיגה־בייט כל אחת |
| רוחב פס זיכרון לכל GPU | 19.6 טרה־בייט לשנייה |
| רוחב פס זיכרון מצטבר | כ־1.7 פטה־בייט לשנייה בכל מדף |
| ביצועי FP4 | עד 2.9 אקסה־פלופס בכל מדף |
| ביצועי FP8 | עד 1.4 אקסה־פלופס בכל מדף |
| רוחב פס Scale-up | 260 טרה־בייט לשנייה |
| רוחב פס Scale-out | 43 טרה־בייט לשנייה |
| מבנה פיזי | 18 מגשי מחשוב מקוררים בנוזל, ארבעה GPUs בכל מגש, ועוד שישה מגשי מתגים |
| ביצועים לכל GPU | 40 פטה־פלופס FP4 ו־20 פטה־פלופס FP8 |
בכל מגש מחשוב נמצאים ארבעה מאיצי MI455X, מעבד EPYC Venice יחיד ורכיבי תקשורת Pensando. באמצעות UALink, כל 72 המאיצים יכולים לפעול כיחידת מחשוב אחת .
AMD ציינה כמה לקוחות מוקדמים למערכת, בהם :
Anthropic, שפועלת גם היא בתחום מודלי ה־AI, לא הוזכרה בפומבי כלקוחה מוקדמת של Helios בהודעות המרכזיות שפורסמו עד יולי 2026 .
המהלך של מיקרוסופט מדגיש שהתחרות בין AMD ל־Nvidia אינה מתנהלת עוד רק סביב שבב GPU בודד. ספקיות הענן הגדולות בוחנות מערכות שלמות: מאיצים, זיכרון, מעבדים, קישוריות, קירור ותוכנה.
היתרון המרכזי ש־AMD מנסה להבליט הוא כמות הזיכרון הגדולה של Helios — 31 טרה־בייט HBM4 במדף אחד — לצד קישוריות מבוססת Ethernet ותקנים פתוחים. מאפיינים אלה עשויים להיות חשובים במיוחד בהרצת מודלים גדולים, שבהם קיבולת הזיכרון ורוחב הפס משפיעים ישירות על קצב העיבוד ועל העלות לכל טוקן .
Helios צפויה להתחיל להישלח במחצית השנייה של 2026. רק לאחר שהמערכות יפעלו בהיקפים מסחריים ויפורסמו מבחני ביצועים בלתי תלויים יהיה אפשר לבדוק אם היתרון שעליו מצהירה AMD מתורגם גם ליתרון אמיתי בעלות ובתפוקה .