Helios ไม่ใช่ชิปเพียงตัวเดียว แต่เป็นระบบทั้งแร็กที่รวมหน่วยประมวลผล, ซีพียู, หน่วยความจำ และเครือข่ายไว้ด้วยกัน เพื่อรองรับการฝึกและการรันโมเดล AI ขนาดใหญ่
ในหนึ่งแร็กประกอบด้วย:
MI455X คือชิปเร่งความเร็ว AI รุ่นสำคัญที่ขับเคลื่อน Helios และเป็นหนึ่งในผลิตภัณฑ์เรือธงของ AMD สำหรับงาน AI ระดับสูง
Su เรียก Helios ว่า “แร็ก AI ที่ดีที่สุดในโลก” และระบุว่าเป็นแร็ก AI ที่มีประสิทธิภาพสูงสุดในอุตสาหกรรมสำหรับการฝึกและรันโมเดลแนวหน้าในระดับมหาศาล อย่างไรก็ตาม นี่เป็นคำกล่าวอ้างจาก AMD ไม่ใช่ผลทดสอบอิสระ
AMD ระบุว่า Helios เข้าสู่การผลิตเต็มรูปแบบแล้ว และจะจัดส่งในช่วงการจัดซื้อใกล้เคียงกับ Vera Rubin NVL72 ของ NVIDIA
ราคา: อยู่ที่ประมาณ 5–5.5 ล้านดอลลาร์ต่อแร็ก หรือราว 5.25 ล้านดอลลาร์ หากคำนวณจากค่ากึ่งกลางของช่วงราคา
AMD เปิดตัว EPYC Venice รุ่นที่ 6 ในเชิงพาณิชย์ภายในงาน โดยใช้สถาปัตยกรรม Zen 6 และกระบวนการผลิตระดับ 2 นาโนเมตรของ TSMC
บริษัทระบุว่า Venice เป็นซีพียูเซิร์ฟเวอร์ x86 รุ่นแรกของอุตสาหกรรมที่สร้างบนโหนด 2 นาโนเมตร ซีพียูรุ่นนี้ทำหน้าที่เป็นแกนประมวลผลของแต่ละถาดใน Helios และรองรับสูงสุด 256 คอร์ Zen 6
AMD วางจุดขายของ Helios ไว้ที่หน่วยความจำและแบนด์วิดท์ ซึ่งมีความสำคัญอย่างมากกับงานอนุมาน หรือการให้โมเดล AI สร้างคำตอบแบบเรียลไทม์ โดยเฉพาะเมื่อโมเดลมีขนาดใหญ่จนต้องเก็บข้อมูลไว้ในหน่วยความจำจำนวนมาก
ตามข้อมูลที่ใช้เปรียบเทียบในรายงาน:
จุดสำคัญคือ AMD อาจได้เปรียบในงานอนุมานที่ต้องการแบนด์วิดท์และความจุหน่วยความจำสูง แต่การประเมินจากนักวิเคราะห์ยังชี้ว่า NVIDIA มีความได้เปรียบด้านประสิทธิภาพการฝึกโมเดลและความ成熟ของซอฟต์แวร์ CUDA
AMD ระบุว่ามีลูกค้ารายใหญ่และพันธมิตรหลายรายกำลังนำแพลตฟอร์มของบริษัทไปใช้งานหรือทดสอบในระดับขนาดใหญ่
| ลูกค้า | ขนาดหรือสถานะการใช้งาน |
|---|---|
| Microsoft Azure | ลูกค้าหลักของ Helios โดยเริ่มจัดส่งในช่วงครึ่งหลังของปี 2026 |
| OpenAI | วางแผนติดตั้งโครงสร้างพื้นฐาน AMD สูงสุด 6 กิกะวัตต์ และมีการใช้งานแร็ก Helios แล้ว |
| Meta | เมื่อรวมกับ OpenAI จะมีความต้องการกำลังประมวลผล AI จาก AMD สูงสุด 12 กิกะวัตต์ |
| Oracle | ระบุชื่อเป็นลูกค้ากลุ่มแรกของ Helios |
| Anthropic | วางแผนติดตั้ง Helios สูงสุด 2 กิกะวัตต์ |
| AT&T | นำแพลตฟอร์ม AMD ไปใช้หรือทดสอบ |
| Cisco | นำแพลตฟอร์ม AMD ไปใช้หรือทดสอบ |
ข่าวประชาสัมพันธ์อย่างเป็นทางการของ AMD ยังระบุ Cerebras เป็นผู้ร่วมมือด้วย
หนึ่งในประกาศใหญ่ที่สุดเกิดขึ้นเมื่อวันที่ 22 กรกฎาคม ซึ่งเป็นวันแรกของงาน
รายละเอียดหลัก ได้แก่:
Tom Brown ผู้ร่วมก่อตั้ง Anthropic ระบุถึงความสะดวกในการผสานระบบและประสิทธิภาพเป็นเหตุผลสำคัญของความร่วมมือครั้งนี้
ดีลดังกล่าวจึงไม่ใช่เพียงการซื้อชิป แต่เป็นความสัมพันธ์เชิงกลยุทธ์ที่ผูกการลงทุนของ AMD เข้ากับการขยายโครงสร้างพื้นฐานของ Anthropic
เมื่อวันที่ 23 กรกฎาคม AMD ประกาศความร่วมมือด้านเทคนิคกับ Cerebras เพื่อพัฒนาสถาปัตยกรรมการอนุมาน AI แบบ disaggregated หรือการแยกงานประมวลผลออกไปยังฮาร์ดแวร์ที่เหมาะกับแต่ละหน้าที่
แนวทางนี้จะทำให้:
ลูกค้าจึงสามารถแบ่งงานอนุมานระหว่างสองระบบได้ เหมาะกับแอปพลิเคชันที่ต้องตอบสนองเร็ว เช่น ผู้ช่วย AI และบริการ AI แบบโต้ตอบ โซลูชันร่วมนี้คาดว่าจะเปิดให้ใช้งานผ่าน Cerebras Cloud ในช่วงครึ่งหลังของปี 2026
| รายการ | AMD Helios (MI455X) | NVIDIA Vera Rubin NVL72 |
|---|---|---|
| ราคาแร็ก | 5–5.5 ล้านดอลลาร์ต่อแร็ก | ยังไม่เปิดเผยอย่างเป็นทางการ |
| GPU ต่อแร็ก | MI455X จำนวน 72 ตัว | Rubin จำนวน 72 ตัว |
| หน่วยความจำต่อ GPU | HBM3E ขนาด 288 GB | ประมาณ 288 GB ตามตัวเลขประมาณการ |
| หน่วยความจำรวมต่อแร็ก | ประมาณ 20.7 TB | ประมาณ 20.7 TB ตามตัวเลขประมาณการ |
| แบนด์วิดท์ | AMD อ้างว่าแบนด์วิดท์ต่อ GPU สูงกว่า | ได้เปรียบด้านการเชื่อมต่อระหว่างชิปผ่าน NVLink |
| ประสิทธิภาพการฝึกโมเดล | ยังตามหลัง NVIDIA ตามการประเมินของนักวิเคราะห์ | ยังเป็นผู้นำ |
| ซอฟต์แวร์ | ROCm แบบโอเพนซอร์สและกำลังเติบโต | CUDA มีระบบนิเวศ成熟และใช้งานแพร่หลาย |
| ส่วนแบ่งตลาดปี 2026 | ประมาณ 5–7% | ประมาณ 80% |
สาระสำคัญจาก Advancing AI 2026 คือ AMD พยายามเปลี่ยนสนามแข่งขันจากการขายชิปเดี่ยว ไปสู่การขายระบบ AI แบบครบชุด ตั้งแต่ GPU MI455X, ซีพียู Venice, เครือข่าย Pensando ไปจนถึงซอฟต์แวร์ ROCm
การที่ Helios เข้าสู่ตลาดในช่วงเวลาใกล้เคียงกับ Vera Rubin ทำให้ทั้งสองระบบมีโอกาสแข่งขันเพื่อคำสั่งซื้อจากผู้ให้บริการคลาวด์และบริษัท AI รายเดียวกันเป็นครั้งแรกในระดับแร็กสเกล
อย่างไรก็ดี ตัวเลขด้านหน่วยความจำและประสิทธิภาพจำนวนมากยังเป็นคำกล่าวอ้างของ AMD หรือประมาณการจากแหล่งข่าว ขณะที่ NVIDIA ยังคงมีฐานตลาดและระบบนิเวศ CUDA ที่แข็งแกร่งกว่า ดังนั้น ความสำเร็จของ Helios จะไม่ได้วัดจากสเปกบนกระดาษเพียงอย่างเดียว แต่ขึ้นอยู่กับการส่งมอบจริง ประสิทธิภาพเมื่อใช้งานจริง และความง่ายในการย้ายซอฟต์แวร์จากระบบ NVIDIA มายัง ROCm ด้วย