Microsoft’un Azure’da Nvidia Vera Rubin NVL72 sistemlerini de kullanacak olması, yapay zekâ altyapısında belirgin bir çift tedarikçili stratejiye işaret ediyor .
Microsoft’un iki farklı donanım platformuna yönelmesinin temelinde tedarik zinciri riskini azaltma ve tek bir üreticiye bağımlı kalmama hedefi bulunuyor . Şirket böylece hem olası ürün tahsis kısıtlamalarına karşı daha esnek hareket edebilir hem de donanım tedarikçileriyle görüşmelerde daha güçlü bir pazarlık pozisyonu elde edebilir.
Bu yaklaşım, Microsoft’un Azure ve Copilot tarafında benimsediği modelden bağımsız çalışma anlayışıyla da örtüşüyor. Microsoft CEO’su Satya Nadella, Azure’un “AMD Helios ve Nvidia Vera Rubin tabanlı yeni nesil rack ölçekli yapay zekâ altyapısını” ilk kullanan bulut sağlayıcıları arasında olacağını söyledi .
Kısacası Microsoft, yapay zekâ yarışında bütün hesaplarını tek bir karta bağlamak istemiyor. AMD ve Nvidia sistemlerini birlikte işletmek, şirkete hem kapasite planlamasında hem de farklı iş yükleri için platform seçerken operasyonel esneklik sağlayabilir.
AMD ve Microsoft, Helios için kesin bir satış fiyatı veya Microsoft’un alacağı toplam kapasiteyi açıklamadı. Ancak Futurum Group’un analist tahminleri iki sistem arasında önemli bir fiyat farkı olduğunu gösteriyor:
Bu tahminler, Helios’un raf başına yaklaşık yüzde 40 daha pahalı olabileceğine işaret ediyor . Fiyat priminin; daha yüksek bellek kapasitesi, Ethernet tabanlı açık mimari ve AMD’nin GPU, CPU ile ağ bileşenlerini tek bir entegre çözümde sunmasından kaynaklanabileceği değerlendiriliyor .
AMD, Helios’un yüksek satın alma maliyetini performans ve verimlilik avantajıyla telafi edebileceğini savunuyor. Şirketin laboratuvar verilerine göre Helios, Nvidia Vera Rubin NVL72’ye kıyasla şu sonuçları sunuyor:
AMD CEO’su Lisa Su, Advancing AI 2026 etkinliğinde Helios’un en büyük modellerde rakip çözümlere göre yüzde 15 veya daha fazla performans sunduğunu, yüzde 50 daha fazla HBM kapasitesine sahip olduğunu ve dolar başına yüzde 30’a kadar daha fazla token üretebildiğini söyledi .
Ancak bu karşılaştırmaların henüz üretim ortamında doğrulanmadığı unutulmamalı. Futurum Group, AMD’nin yüzde 15 performans ve yüzde 30 token başına maliyet avantajı iddialarının piyasaya çıkmamış bir rakibe karşı yapılan şirket hesaplamalarına dayandığına dikkat çekiyor. Gerçek sonuçların, sistemler üretimde çalışmaya başladıktan sonraki iki çeyrekte görülebileceği belirtiliyor .
Helios, AMD’nin bugüne kadarki en kapsamlı yapay zekâ altyapısı olarak konumlandırdığı, sıvı soğutmalı ve raf ölçekli bir sistem. Bir rafın temel özellikleri şöyle:
| Bileşen | Özellik |
|---|---|
| GPU | 72 adet AMD Instinct MI455X |
| GPU mimarisi | CDNA 5; TSMC’nin 2 nm ve 3 nm çiplet teknolojilerini kullanan hibrit tasarım |
| GPU başına transistör | 320 milyar |
| CPU | 18 adet 6. nesil AMD EPYC “Venice”; her işlem rafında bir CPU |
| Ağ bağlantısı | AMD Pensando “Vulcano” 800 AI NIC; 800 Gbps Ethernet ve GPU başına 2,4 Tbps’ye kadar ölçekleme |
| Raf içi bağlantı | UALink; Ethernet üzerinden tünellenen Ultra Accelerator Link |
| Raflar arası bağlantı | Ultra Ethernet Consortium standartlarıyla uyumlu |
| Toplam HBM4 belleği | Raf başına 31 TB |
| GPU başına bellek | 432 GB; 36 GB’lık 12 HBM4 yığını |
| GPU başına bellek bant genişliği | 19,6 TB/sn |
| Toplam bellek bant genişliği | Raf başına yaklaşık 1,7 PB/sn |
| FP4 performansı | Raf başına 2,9 exaFLOPS |
| FP8 performansı | Raf başına 1,4 exaFLOPS |
| Raf içi ölçekleme bant genişliği | 260 TB/sn |
| Raflar arası ölçekleme bant genişliği | 43 TB/sn |
| Form faktörü | 18 sıvı soğutmalı işlem rafı ve 6 anahtar rafı; OCP Open Rack Wide uyumlu |
| GPU başına performans | 40 PFLOPS FP4 ve 20 PFLOPS FP8 |
Her işlem rafında dört MI455X GPU, bir EPYC Venice CPU ve Pensando ağ bileşenleri bulunuyor. UALink bağlantısı sayesinde raftaki 72 GPU, ayrı hızlandırıcılar yerine tek bir büyük hesaplama birimi gibi çalışacak şekilde birbirine bağlanıyor .
AMD’nin açıkladığı erken dönem Helios müşterileri arasında şu şirketler yer alıyor :
Buna karşılık Anthropic, Temmuz 2026 itibarıyla büyük duyurularda AMD Helios’un erken müşterisi olarak kamuya açık biçimde açıklanmadı . Bu nedenle Anthropic’in Helios kullandığına ilişkin doğrulanmış bir bilgi bulunmuyor.
Microsoft’un hem AMD Helios hem de Nvidia Vera Rubin sistemlerine yatırım yapması, yapay zekâ altyapısı pazarının yalnızca GPU seçimi üzerinden şekillenmediğini gösteriyor. Büyük bulut sağlayıcıları artık tedarik güvenliğini artırmak, maliyetleri kontrol etmek ve farklı bellek ile ağ mimarilerinden yararlanmak için birden fazla platforma yöneliyor .
Helios’un öne çıkan tarafı, özellikle büyük modellerin çıkarımında kritik olan bellek kapasitesi ve bant genişliği. AMD’nin 31 TB HBM4 belleğe sahip raf tasarımı, model ağırlıklarının ve ara verilerin daha büyük bir bölümünü aynı sistem içinde tutmayı hedefliyor. Ethernet tabanlı açık bağlantı yaklaşımı da AMD’nin Nvidia’nın daha kapalı ve entegre ekosistemine karşı sunduğu temel farklılıklardan biri olarak öne çıkıyor .
Helios sevkiyatlarının 2026’nın ikinci yarısında başlaması bekleniyor . Bu nedenle asıl sınav, sistemler gerçek Azure iş yüklerinde çalışmaya başladığında ve bağımsız üretim testleri yayımlandığında yaşanacak. AMD’nin performans ve dolar başına token iddialarının ne ölçüde karşılık bulduğu da ancak bu aşamada netleşecek .