تتعمد مايكروسوفت تقسيم بنيتها التحتية للجيل القادم من الذكاء الاصطناعي بين AMD Helios و Nvidia Vera Rubin لتقليل مخاطر سلسلة التوريد وتجنب الاحتكار من مورد واحد . يعكس هذا النهج سياسة الشركة المحايدة تجاه النماذج داخل أزور و Copilot . أكد الرئيس التنفيذي ساتيا ناديلا أن الشركة "ستكون من بين أول مزودي الخدمات السحابية الذين ينشرون بنية تحتية للذكاء الاصطناعي من الجيل التالي تعتمد على AMD Helios و Nvidia Vera Rubin"، مما يمنح مايكروسوفت قوة تفاوضية ومرونة تشغيلية . يوصف هذا التوجه في الصناعة بأنه "توزيع للمخاطر" .
لم تكشف AMD أو مايكروسوفت عن الأسعار الدقيقة، لكن تقديرات محللي مجموعة Futurum تقدم مقارنة واضحة:
هذا يجعل Helios أغلى بنحو 40% على أساس المقارنة بين رف وآخر . ويعزى هذا الفارق إلى سعة الذاكرة الأعلى في Helios، وهندسته المفتوحة، وحزمة المعالجات المتكاملة من AMD .
تجادل AMD بأن التكلفة الأولية الأعلى لـ Helios تُبرر بكفاءة أداء فائقة. وفقًا لبيانات مختبرات AMD الخاصة، يوفر Helios :
قدمت الرئيسة التنفيذية لـ AMD، ليزا سو، هذه الأرقام في حدث "Advancing AI 2026"، مشيرة إلى أن Helios يقدم "أداءً أفضل بنسبة 15% أو أكثر من المنافس على أكبر النماذج، وسعة HBM أكبر بنسبة 50%، وما يصل إلى 30% زيادة في الوحدات لكل دولار" .
ومع ذلك، يحذر المحللون من أن هذه تقديرات ما قبل الإنتاج. أشارت مجموعة Futurum إلى أن "ادعاءات AMD بتفوق أداء بنسبة 15% وزيادة 30% في الوحدات لكل دولار تظل حسابات بائع ضد منافس لم يُشحن بعد، وسيتم اختبارها في الإنتاج خلال ربعين" .
AMD Helios هو نظام مخصص للرف الواحد مزود بالتبريد السائل، وهو يمثل أقوى عروض أجهزة الذكاء الاصطناعي من AMD حتى الآن :
| المكون | المواصفات |
|---|---|
| المعالجات الرسومية (GPUs) | 72x AMD Instinct MI455X |
| معمارية GPU | CDNA 5 (خليط من شرائح 2nm/3nm في TSMC) |
| الترانزستورات لكل GPU | 320 مليار |
| المعالج المركزي (CPU) | 18x من الجيل السادس AMD EPYC "Venice" (واحد لكل درج حسابي، حتى 256 نواة لكل CPU) |
| الشبكات | AMD Pensando "Vulcano" 800 AI NICs (بسرعة 800 جيجابت في الثانية للإيثرنت، حتى 2.4 تيرابت في الثانية لكل GPU للتوسع) |
| الربط الداخلي (Scale-up) | UALink (بروتوكول Ultra Accelerator Link عبر الإيثرنت) |
| الربط الخارجي (Scale-out) | متوافق مع اتحاد Ultra Ethernet Consortium (UEC) |
| إجمالي ذاكرة HBM4 | 31 تيرابايت لكل رف |
| الذاكرة لكل GPU | 432 جيجابايت (12 مجموعة من HBM4 بسعة 36 جيجابايت لكل منها) |
| عرض النطاق الترددي للذاكرة لكل GPU | 19.6 تيرابايت/ثانية |
| عرض النطاق الترددي الإجمالي للذاكرة | 1.7 بيتابايت/ثانية لكل رف |
| أداء FP4 | 2.9 إكسافلوبس لكل رف |
| أداء FP8 | 1.4 إكسافلوبس لكل رف |
| عرض النطاق الترددي للربط الداخلي | 260 تيرابايت/ثانية |
| عرض النطاق الترددي للربط الخارجي | 43 تيرابايت/ثانية |
| عامل الشكل | 18 درجًا حسابيًا مبردًا بالسوائل (4GPUs لكل منها) + 6 أدراج للمفاتيح، متوافق مع OCP Open Rack Wide |
| أداء كل GPU | 40 بيتافلوبس FP4، 20 بيتافلوبس FP8 |
يحتوي كل درج حسابي على أربع معالجات MI455X مقترنة بمعالج EPYC Venice واحد وشبكات Pensando، وجميعها متصلة عبر بروتوكول UALink للسماح للمعالجات الـ 72 بالعمل كوحدة حوسبة واحدة .
حصلت AMD على العملاء الأوائل التاليين لـ Helios :
غياب ملحوظ: لم يتم الإعلان عن Anthropic كأحد عملاء Helios الأوائل حتى يوليو 2026 .
يشير قرار مايكروسوفت بنشر كل من AMD Helios و Nvidia Vera Rubin إلى أن سوق أجهزة الذكاء الاصطناعي دخل مرحلة جديدة. فبدلاً من الاعتماد على مورد واحد، يستثمر كبار مزودي الخدمات السحابية في تنويع المنصات لتأمين التوريد وتحسين القوة التفاوضية والوصول إلى خصائص أداء متميزة .
يعتبر AMD Helios، بذاكرته الضخمة HBM4 التي تبلغ 31 تيرابايت واتصالاته المفتوحة القائمة على الإيثرنت، مناسبًا بشكل خاص لأعباء عمل الاستنتاج واسعة النطاق، حيث تؤدي سعة الذاكرة وعرض النطاق الترددي إلى زيادة الإنتاجية وخفض التكلفة لكل وحدة (token) . مع توقع بدء الشحن في النصف الثاني من عام 2026، سيكون الاختبار الحقيقي عندما تُنشر معايير الإنتاج ويمكن التحقق من الادعاءات المتنافسة على نطاق واسع .