Dikembangkan bersama oleh AMD, Supermicro, dan Spectro Cloud, platform ini diumumkan pada 5 Agustus 2026 di konferensi Ai4 2026 di Las Vegas . Berikut cara kerjanya, biayanya, dan untuk siapa solusi ini dirancang.
AMD Instinct Coder menggunakan routing model cerdas berbasis kebijakan sebagai pembeda utamanya . Permintaan coding rutin — seperti pembuatan kode, perangkuman, atau refactoring — dilayani secara lokal oleh model GLM-5.2 mixture-of-experts yang dioptimalkan AMD (744B parameter total, dengan sekitar 40B parameter yang diaktifkan per token) . Permintaan penalaran yang kompleks dapat diteruskan ke model frontier seperti OpenAI GPT, Anthropic Claude, atau Google Gemini jika model lokal tidak mampu menanganinya . Desain inferensi berjenjang inilah yang menjadi mekanisme di balik klaim penghematan biaya .
Sistem referensi adalah sebuah appliance terintegrasi rak yang telah divalidasi sebelumnya dan dikirim sebagai satu SKU :
| Komponen | Spesifikasi |
|---|---|
| CPU | 2x AMD EPYC 9575F (64 core masing-masing, 3,3 GHz) |
| GPU | 8x AMD Instinct MI325X (memori HBM3E 256 GB masing-masing, bandwidth puncak 6 TB/s), tersedia varian berpendingin udara atau cair |
| Jaringan | 2x AMD Pensando Pollara 400 Gb/s SmartNIC |
| Chassis | Supermicro AS-8126GS-TNMR, telah divalidasi penuh dan terintegrasi rak |
Sistem ini dirancang sebagai appliance yang "colok saja, nyalakan, dan langsung berfungsi", tersedia sebagai satu SKU pada akhir kuartal peluncurannya .
PaletteAI Inference Launchpad dari Spectro Cloud adalah lapisan software yang membuat hardware tersebut berguna. Ia menyediakan :
AMD dan Spectro Cloud mengklaim platform ini dapat mengurangi biaya token AI coding hingga 70% dibandingkan mengirim semua permintaan ke API model frontier berbasis cloud . Materi AMD sendiri menyebutkan periode pengembalian modal (payback period) yang singkat, yaitu enam bulan . Klaim ini belum diverifikasi secara independen, dan penghematan aktual akan bergantung pada campuran beban kerja, pola penggunaan, dan harga API cloud masing-masing organisasi .
Dan McNamara (SVP & GM, Compute & Enterprise AI, AMD):
"Organisasi membutuhkan kendali atas di mana kode diproses, model mana yang digunakan, dan berapa biaya penggunaannya. AMD Instinct Coder menggabungkan komputasi AMD berkinerja tinggi dan ekosistem software terbuka dengan teknologi Supermicro dan Spectro Cloud, memberi pelanggan cara sederhana untuk menjalankan lebih banyak beban kerja secara lokal, menggunakan model frontier secara selektif, dan mengoperasikan infrastruktur mereka sendiri."
Tenry Fu (Co-founder & CEO, Spectro Cloud):
"Organisasi tidak seharusnya memilih antara kemampuan model frontier dengan ekonomi dan kendali inferensi lokal."
Vik Malyala (SVP, AI and Enterprise, Supermicro):
Peran Supermicro mencakup pra-validasi, integrasi rak, dan kualifikasi sistem untuk mengurangi kerumitan penerapan dan memperpendek jalur dari hardware yang dikirim ke inferensi produksi .
Platform ini diluncurkan di Ai4 2026 (4–6 Agustus di Las Vegas) . Peluncuran ini merespons masalah nyata di perusahaan: saat organisasi memperluas agen coding AI di seluruh tim pengembangan dan alur kerja otomatis, biaya token meningkat dengan cepat. BMC, salah satu pengadopsi awal, telah menggunakan platform ini untuk pekerjaan Helix Agentic Engineering mereka .
AMD Instinct Coder diposisikan sebagai alternatif on-premise yang terkelola untuk asisten coding berbasis cloud murni, menyeimbangkan kemampuan, biaya, dan kendali bagi perusahaan yang tidak dapat atau tidak mau mengirim kode sumber proprietary ke API pihak ketiga.