Platforma została opracowana wspólnie przez AMD, Supermicro i Spectro Cloud, a jej premiera odbyła się 5 sierpnia 2026 roku podczas konferencji Ai4 2026 w Las Vegas . Poniżej wyjaśniamy, jak działa, ile kosztuje i dla kogo jest przeznaczona.
Kluczowym wyróżnikiem AMD Instinct Coder jest inteligentne routowanie modeli oparte na politykach . Rutynowe zapytania programistyczne – generowanie kodu, podsumowywanie, refaktoryzacja – są obsługiwane lokalnie przez zoptymalizowany przez AMD model GLM-5.2 (architektura mixture-of-experts, 744 mld parametrów łącznie, około 40 mld aktywowanych na token) . Gdy lokalny model nie poradzi sobie ze złożonym zadaniem, zapytanie może zostać przekierowane do modeli chmurowych, takich jak OpenAI GPT, Anthropic Claude czy Google Gemini . To właśnie ten warstwowy projekt inferencji odpowiada za deklarowane oszczędności .
System referencyjny to wstępnie zatwierdzone, zintegrowane urządzenie rackowe, dostępne jako pojedynczy SKU :
| Komponent | Specyfikacja |
|---|---|
| Procesory | 2x AMD EPYC 9575F (64 rdzenie każdy, 3,3 GHz) |
| GPU | 8x AMD Instinct MI325X (256 GB pamięci HBM3E każdy, szczytowa przepustowość 6 TB/s), dostępne w wersji chłodzonej powietrzem lub cieczą |
| Sieć | 2x AMD Pensando Pollara 400 Gb/s SmartNIC |
| Obudowa | Supermicro AS-8126GS-TNMR, w pełni zatwierdzona i zintegrowana w szafie rack |
System został zaprojektowany jako urządzenie „plug & play” – „podłączasz je, dosłownie włączasz i działa” – i ma być dostępny jako pojedynczy SKU do końca kwartału, w którym został wprowadzony na rynek .
PaletteAI Inference Launchpad od Spectro Cloud to warstwa oprogramowania, która sprawia, że sprzęt jest użyteczny. Zapewnia :
AMD i Spectro Cloud twierdzą, że platforma może obniżyć koszty tokenów kodowania AI nawet o 70% w porównaniu z wysyłaniem wszystkich zapytań do interfejsów API modeli chmurowych . Materiały AMD wskazują na okres zwrotu inwestycji wynoszący zaledwie sześć miesięcy . Należy jednak pamiętać, że deklaracje te nie zostały niezależnie zweryfikowane, a rzeczywiste oszczędności będą zależeć od miksu zadań, wzorców użycia i cen interfejsów API w chmurze .
Dan McNamara (SVP & GM, Compute & Enterprise AI, AMD):
„Organizacje potrzebują kontroli nad tym, gdzie przetwarzany jest kod, które modele są używane i ile to kosztuje. AMD Instinct Coder łączy wysokowydajne obliczenia AMD z otwartym ekosystemem oprogramowania oraz technologiami Supermicro i Spectro Cloud, dając klientom prosty sposób na uruchamianie większej liczby obciążeń lokalnie, selektywne korzystanie z modeli chmurowych i samodzielne zarządzanie infrastrukturą.”
Tenry Fu (współzałożyciel i dyrektor generalny Spectro Cloud):
„Organizacje nie powinny mieć wyboru między możliwościami modeli chmurowych a ekonomią i kontrolą lokalnej inferencji.”
Vik Malyala (SVP, AI i Enterprise, Supermicro):
Rola Supermicro obejmuje wstępną walidację, integrację w szafie rack i kwalifikację systemu, co ma na celu zmniejszenie złożoności wdrożenia i skrócenie czasu od dostarczenia sprzętu do produkcyjnej inferencji .
Platforma została zaprezentowana na targach Ai4 2026 (4–6 sierpnia w Las Vegas) . Premiera odpowiada na realny problem przedsiębiorstw: wraz ze skalowaniem agentów kodowania AI w zespołach deweloperskich i zautomatyzowanych przepływach pracy, koszty tokenów szybko rosną. Wczesnym użytkownikiem jest BMC, który wdrożył platformę dla swojej pracy Helix Agentic Engineering .
AMD Instinct Coder jest pozycjonowany jako nadzorowana, lokalna alternatywa dla czysto chmurowych asystentów kodowania, równoważąca możliwości, koszty i kontrolę dla firm, które nie mogą lub nie chcą wysyłać zastrzeżonego kodu źródłowego do interfejsów API stron trzecich.