AMD, Supermicro ve Spectro Cloud tarafından ortaklaşa geliştirilen platform, 5 Ağustos 2026'da Las Vegas'taki Ai4 2026 konferansında duyuruldu . İşte platformun nasıl çalıştığı, maliyeti ve kimler için uygun olduğu.
AMD Instinct Coder'ın temel farklılaştırıcısı, politika tabanlı, akıllı model yönlendirme özelliğidir . Rutin kodlama talepleri (kod oluşturma, özetleme, yeniden düzenleme), AMD tarafından optimize edilmiş GLM-5.2 karma-uzman modeli (toplam 744 milyar parametre, token başına yaklaşık 40 milyar parametre aktif) tarafından yerel olarak işlenir . Karmaşık akıl yürütme gerektiren sorgular, yerel modelin üstesinden gelemediği durumlarda OpenAI GPT, Anthropic Claude veya Google Gemini gibi gelişmiş modellere yönlendirilebilir . Bu katmanlı çıkarım tasarımı, iddia edilen maliyet tasarruflarının arkasındaki mekanizmadır .
Referans sistem, önceden doğrulanmış, rafa monte edilmiş ve tek bir ürün koduyla (SKU) gönderilen bir cihazdır :
| Bileşen | Özellik |
|---|---|
| İşlemciler | 2x AMD EPYC 9575F (64 çekirdek, 3.3 GHz) |
| GPU'lar | 8x AMD Instinct MI325X hızlandırıcı (her biri 256 GB HBM3E bellek, 6 TB/s bant genişliği), hava veya sıvı soğutmalı seçeneklerle |
| Ağ | 2x AMD Pensando Pollara 400 Gb/s SmartNIC |
| Kasa | Supermicro AS-8126GS-TNMR, tamamen doğrulanmış ve rafa monte |
Sistem, "fişe tak, fiilen aç ve çalışsın" mantığıyla tasarlanmış bir cihaz olarak, lansman çeyreğinin sonunda tek bir ürün koduyla sipariş edilebilir hale gelecek .
Spectro Cloud'un PaletteAI Inference Launchpad yazılımı, donanımı işlevsel kılan temel katmandır. Şu özellikleri sağlar :
AMD ve Spectro Cloud, platformun tüm talepleri bulut tabanlı gelişmiş model API'lerine göndermeye kıyasla yapay zeka kodlama token maliyetlerini %70'e kadar düşürebileceğini iddia ediyor . AMD'nin kendi materyalleri, sermaye yatırımının geri dönüş süresini altı ay kadar kısa bir süre olarak gösteriyor . Bu iddialar bağımsız olarak doğrulanmamıştır ve gerçek tasarruflar, kuruluşun iş yükü karışımına, kullanım alışkanlıklarına ve bulut API fiyatlandırmasına bağlı olacaktır .
Dan McNamara (AMD, Kıdemli Başkan Yardımcısı ve Genel Müdür, Bilgi İşlem ve Kurumsal Yapay Zeka):
"Kuruluşlar, kodun nerede işlendiği, hangi modellerin kullanıldığı ve bu kullanımın maliyeti üzerinde kontrole ihtiyaç duyar. AMD Instinct Coder, yüksek performanslı AMD bilgi işlem ve açık bir yazılım ekosistemini Supermicro ve Spectro Cloud teknolojileriyle birleştirerek müşterilere daha fazla iş yükünü yerel olarak çalıştırmak, gelişmiş modelleri seçici olarak kullanmak ve altyapıyı kendileri işletmek için basit bir yol sunuyor."
Tenry Fu (Eş-Kurucu ve CEO, Spectro Cloud):
"Kuruluşlar, gelişmiş modellerin yetenekleri ile yerel çıkarımın ekonomisi ve kontrolü arasında seçim yapmak zorunda kalmamalı."
Vik Malyala (Kıdemli Başkan Yardımcısı, Yapay Zeka ve Kurumsal, Supermicro):
Supermicro'nun rolü, dağıtım karmaşıklığını azaltmak ve teslim edilen donanımdan üretim çıkarımına giden yolu kısaltmak için ön doğrulama, raf entegrasyonu ve sistem kalifikasyonunu içerir .
Platform, Ai4 2026'da (4-6 Ağustos, Las Vegas) tanıtıldı . Lansman, net bir kurumsal soruna yanıt veriyor: kuruluşlar yapay zeka kodlama ajanlarını geliştirme ekipleri ve otomatik iş akışları genelinde ölçeklendirdikçe token maliyetleri hızla yükseliyor. İlk benimseyenlerden BMC, platformu Helix Agentic Engineering çalışmaları için zaten kullanıma aldı .
AMD Instinct Coder, tescilli kaynak kodunu üçüncü taraf API'lerine gönderemeyen veya göndermek istemeyen kuruluşlar için yetenek, maliyet ve kontrolü dengeleyen, yönetilebilir, şirket içi bir alternatif olarak konumlandırılıyor.