Sviluppata congiuntamente da AMD, Supermicro e Spectro Cloud, la piattaforma è stata annunciata il 5 agosto 2026 alla conferenza Ai4 2026 a Las Vegas . Ecco come funziona, quanto costa e a chi è destinata.
AMD Instinct Coder si distingue per il suo routing intelligente dei modelli basato su policy . Le richieste di coding di routine (generazione di codice, riepilogo, refactoring) vengono gestite localmente da un modello GLM-5.2 mixture-of-experts ottimizzato da AMD (744 miliardi di parametri totali, di cui circa 40 miliardi attivati per token) . Le query più complesse possono essere inoltrate a modelli frontier come OpenAI GPT, Anthropic Claude o Google Gemini quando il modello locale non è in grado di gestirle . Questo design di inferenza a livelli è il meccanismo alla base del risparmio sui costi dichiarato .
Il sistema di riferimento è un appliance pre-validato e integrato in rack, venduto come un unico SKU :
| Componente | Specifica |
|---|---|
| CPU | 2x processori AMD EPYC 9575F (64 core ciascuno, 3,3 GHz) |
| GPU | 8x acceleratori AMD Instinct MI325X (256 GB di memoria HBM3E ciascuno, 6 TB/s di larghezza di banda di picco), disponibili in varianti con raffreddamento ad aria o liquido |
| Rete | 2x SmartNIC AMD Pensando Pollara da 400 Gb/s |
| Chassis | Supermicro AS-8126GS-TNMR, completamente validato e integrato in rack |
Il sistema è progettato come un appliance "plug-and-play": basta collegarlo, letteralmente accenderlo e funziona . Sarà disponibile come SKU singolo entro la fine del trimestre di lancio .
Il software PaletteAI Inference Launchpad di Spectro Cloud è il livello di orchestrazione che rende utile l'hardware. Fornisce :
AMD e Spectro Cloud affermano che la piattaforma può ridurre i costi dei token per il coding AI fino al 70% rispetto all'invio di tutte le richieste alle API dei modelli cloud frontier . I materiali AMD citano un periodo di ritorno sull'investimento (payback) di appena sei mesi . Queste affermazioni non sono state verificate in modo indipendente e il risparmio effettivo dipenderà dal carico di lavoro, dai modelli di utilizzo e dai prezzi delle API cloud di ogni organizzazione .
Dan McNamara (SVP & GM, Compute & Enterprise AI, AMD):
"Le organizzazioni hanno bisogno di controllo su dove viene elaborato il codice, quali modelli vengono utilizzati e quanto costa il loro utilizzo. AMD Instinct Coder combina la potenza di calcolo AMD ad alte prestazioni e un ecosistema software aperto con le tecnologie di Supermicro e Spectro Cloud, offrendo ai clienti un modo semplice per eseguire più carichi di lavoro in locale, utilizzare i modelli frontier in modo selettivo e gestire l'infrastruttura in prima persona."
Tenry Fu (Co-fondatore e CEO, Spectro Cloud):
"Le organizzazioni non dovrebbero dover scegliere tra le capacità dei modelli frontier e il controllo economico dell'inferenza locale."
Vik Malyala (SVP, AI and Enterprise, Supermicro):
Il ruolo di Supermicro include la pre-validazione, l'integrazione in rack e la qualificazione del sistema per ridurre la complessità di implementazione e abbreviare il percorso dall'hardware consegnato all'inferenza in produzione .
La piattaforma è stata svelata ad Ai4 2026 (4-6 agosto a Las Vegas) . Il lancio risponde a un chiaro problema delle aziende: man mano che scalano gli agenti di coding AI in team di sviluppo e flussi di lavoro automatizzati, i costi dei token aumentano rapidamente. Un primo cliente, BMC, ha già implementato la piattaforma per il suo lavoro Helix Agentic Engineering .
AMD Instinct Coder si posiziona come un'alternativa on-premise e governata ai puri assistenti di coding basati su cloud, bilanciando capacità, costi e controllo per le aziende che non possono o non vogliono inviare il codice sorgente proprietario a API di terze parti.