Dibangunkan bersama oleh AMD, Supermicro, dan Spectro Cloud, platform ini diumumkan pada 5 Ogos 2026 di persidangan Ai4 2026 di Las Vegas . Berikut adalah cara ia berfungsi, kosnya, dan untuk siapa ia sesuai.
AMD Instinct Coder menggunakan laluan model pintar berasaskan dasar sebagai pembeza utamanya . Permintaan pengekodan rutin — penjanaan kod, rumusan, pengubahsuaian semula — dilayan secara setempat oleh model GLM-5.2 mixture-of-experts yang dioptimumkan AMD (744B jumlah parameter, dengan kira-kira 40B diaktifkan setiap token) . Pertanyaan penaakulan kompleks boleh dihantar ke model termaju seperti OpenAI GPT, Anthropic Claude, atau Google Gemini apabila model tempatan tidak dapat mengendalikannya . Reka bentuk inferens bertingkat ini adalah mekanisme di sebalik penjimatan kos yang didakwa .
Sistem rujukan adalah perkakas pra-sah, bersepadu rak yang dihantar sebagai satu SKU :
| Komponen | Spesifikasi |
|---|---|
| CPU | 2x pemproses AMD EPYC 9575F (64 teras setiap satu, 3.3 GHz) |
| GPU | 8x pemecut AMD Instinct MI325X (256 GB HBM3E memori setiap satu, lebar jalur puncak 6 TB/s), tersedia dalam varian penyejukan udara atau cecair |
| Rangkaian | 2x SmartNIC AMD Pensando Pollara 400 Gb/s |
| Casis | Supermicro AS-8126GS-TNMR, disahkan sepenuhnya dan bersepadu rak |
Sistem ini direka sebagai perkakas "palamkan, hidupkan, dan ia berfungsi", tersedia sebagai satu SKU selewat-lewatnya pada akhir suku tahun pelancarannya .
PaletteAI Inference Launchpad Spectro Cloud adalah lapisan perisian yang menjadikan perkakasan berguna. Ia menyediakan :
AMD dan Spectro Cloud mendakwa platform ini dapat mengurangkan kos token pengekodan AI sehingga 70% berbanding menghantar semua permintaan ke API model awan termaju . Bahan AMD sendiri menyebut tempoh pulangan modal selama enam bulan . Dakwaan ini belum disahkan secara bebas, dan penjimatan sebenar bergantung pada campuran beban kerja, corak penggunaan, dan harga API awan organisasi .
Dan McNamara (SVP & GM, Compute & Enterprise AI, AMD):
"Organisasi memerlukan kawalan ke atas tempat kod diproses, model mana yang digunakan, dan berapa kos penggunaan tersebut. AMD Instinct Coder menggabungkan pengkomputeran AMD berprestasi tinggi dan ekosistem perisian terbuka dengan teknologi Supermicro dan Spectro Cloud, memberi pelanggan cara mudah untuk menjalankan lebih banyak beban kerja secara setempat, menggunakan model termaju secara selektif, dan mengendalikan infrastruktur sendiri."
Tenry Fu (Pengasas Bersama & CEO, Spectro Cloud):
"Organisasi tidak seharusnya terpaksa memilih antara keupayaan model termaju dengan ekonomi dan kawalan inferens setempat."
Vik Malyala (SVP, AI dan Perusahaan, Supermicro):
Peranan Supermicro termasuk pra-sah, integrasi rak, dan kelayakan sistem untuk mengurangkan kerumitan penggunaan dan memendekkan laluan daripada perkakasan dihantar kepada inferens pengeluaran .
Platform ini dilancarkan di Ai4 2026 (4–6 Ogos di Las Vegas) . Pelancaran ini menjawab keperluan perusahaan yang jelas: apabila organisasi meningkatkan ejen pengekodan AI merentasi pasukan pembangunan dan aliran kerja automatik, kos token meningkat dengan cepat. Pengguna awal BMC telah pun menggunakan platform ini untuk kerja Helix Agentic Engineering mereka .
AMD Instinct Coder diposisikan sebagai alternatif terurus, premis sendiri kepada pembantu pengekodan berasaskan awan semata-mata, mengimbangi keupayaan, kos, dan kawalan untuk perusahaan yang tidak boleh atau tidak mahu menghantar kod sumber proprietari kepada API pihak ketiga.