AMD:n, Supermicron ja Spectro Cloudin yhdessä kehittämä alusta julkistettiin 5. elokuuta 2026 Las Vegasissa järjestetyllä Ai4 2026 -konferenssilla . Tässä artikkelissa kerromme, miten se toimii, mitä se maksaa ja kenelle se on tarkoitettu.
AMD Instinct Coderin keskeinen erottava tekijä on käytäntöihin perustuva, älykäs mallireititys . Rutiininomaiset koodauspyynnöt – kuten koodin luominen, yhteenvedot ja uudelleenjärjestelyt – käsitellään paikallisesti AMD:lle optimoidulla GLM-5.2-asiantuntijamallilla (744 miljardia parametria, joista noin 40 miljardia aktivoituu jokaista tokenia kohden) . Monimutkaisemmat päättelykyselyt voidaan ohjata huippumalleille, kuten OpenAI GPT:lle, Anthropic Claudelle tai Google Geminille, kun paikallinen malli ei pysty käsittelemään niitä . Tämä porrastettu päättelyarkkitehtuuri on väitettyjen kustannussäästöjen taustalla .
Referenssijärjestelmä on esivalidoitu, telineeseen integroitu laite, joka toimitetaan yhtenä tuotekoodina :
| Komponentti | Tekniset tiedot |
|---|---|
| Suorittimet | 2x AMD EPYC 9575F -suoritin (64 ydintä kukin, 3,3 GHz) |
| GPU:t | 8x AMD Instinct MI325X -kiihdytin (256 Gt HBM3E-muistia kukin, 6 Tt/s huippukaistanleveys), saatavilla ilma- tai nestejäähdytteisenä |
| Verkotus | 2x AMD Pensando Pollara 400 Gb/s SmartNIC-verkko-ohjain |
| Kotelo | Supermicro AS-8126GS-TNMR, täysin validoitu ja telineeseen integroitu |
Järjestelmä on suunniteltu "kytkeä seinään, kirjaimellisesti kytkeä päälle, ja se toimii" -laitteeksi, ja se on tilattavissa yhtenä tuotekoodina julkaisuneljänneksen loppuun mennessä .
Spectro Cloudin PaletteAI Inference Launchpad on ohjelmistokerros, joka tekee laitteistosta hyödyllisen. Se tarjoaa :
AMD ja Spectro Cloud väittävät alustan voivan vähentää tekoälykoodauksen token-kustannuksia jopa 70 prosenttia verrattuna siihen, että kaikki pyynnöt lähetettäisiin pilvipohjaisille huippumallien rajapinnoille . AMD:n omat materiaalit mainitsevat jopa kuuden kuukauden takaisinmaksuajan pääomasijoitukselle . Nämä väitteet eivät ole riippumattomasti vahvistettuja, ja todelliset säästöt riippuvat organisaation työkuormien yhdistelmästä, käyttötavoista ja pilvipalveluiden hinnoittelusta .
Dan McNamara (johtaja, Compute & Enterprise AI, AMD):
"Organisaatiot tarvitsevat hallinnan siihen, missä koodia käsitellään, mitä malleja käytetään ja mitä se maksaa. AMD Instinct Coder yhdistää tehokkaan AMD-laskennan ja avoimen ohjelmistoekosysteemin Supermicron ja Spectro Cloudin teknologioiden kanssa, antaen asiakkaille yksinkertaisen tavan ajaa enemmän työkuormia paikallisesti, käyttää huippumalleja valikoivasti ja ylläpitää infrastruktuuria itse."
Tenry Fu (perustaja ja toimitusjohtaja, Spectro Cloud):
"Organisaatioiden ei pitäisi joutua valitsemaan huippumallien ominaisuuksien ja paikallisen päättelyn talouden ja hallinnan välillä."
Vik Malyala (johtaja, AI ja yritysmyynti, Supermicro):
Supermicron rooliin kuuluu esivalidointi, telineintegraatio ja järjestelmän laadunvarmistus, jotta käyttöönottoa voidaan yksinkertaistaa ja lyhentää aikaa toimitetusta laitteistosta tuotantokäyttöön .
Alusta julkistettiin Ai4 2026 -konferenssissa (4.–6. elokuuta Las Vegasissa) . Julkaisu vastaa selkeään yritysten kipupisteeseen: kun organisaatiot skaalaavat tekoälykoodausagentteja kehitystiimeissä ja automatisoiduissa työnkuluissa, token-kustannukset nousevat nopeasti. Varhaiskäyttäjä BMC on jo ottanut alustan käyttöön Helix Agentic Engineering -työssään .
AMD Instinct Coder on sijoitettu hallituksi, paikalliseksi vaihtoehdoksi puhtaille pilvipohjaisille koodausavustimille, tasapainottaen kyvykkyyden, kustannukset ja hallinnan yrityksille, jotka eivät voi tai halua lähettää omaa lähdekoodiaan kolmannen osapuolen rajapinnoille.