Platformu, vyvinutou ve spolupráci firem AMD, Supermicro a Spectro Cloud, oznámili 5. srpna 2026 na konferenci Ai4 2026 v Las Vegas . Pojďme se podívat, jak funguje, kolik stojí a pro koho je určena.
Hlavním rozdílem oproti konkurenci je inteligentní směrování požadavků na základě pravidel . Běžné úkoly – generování kódu, sumarizace nebo refaktorování – obslouží lokálně model GLM-5.2 (architektura mixture-of-experts s celkem 744 miliardami parametrů, z nichž se na jeden token aktivuje přibližně 40 miliard), který je optimalizovaný přímo pro akcelerátory AMD . Složitější dotazy, se kterými si lokální model neví rady, mohou být automaticky přeposlány na cloudové modely jako OpenAI GPT, Anthropic Claude nebo Google Gemini . Právě toto dvouúrovňové zpracování je klíčovým mechanismem, který stojí za deklarovanými úsporami .
Základem je předem vyvalidované, do racku integrované zařízení, které se dodává jako jeden logistický celek (jedno SKU) :
| Komponent | Specifikace |
|---|---|
| CPU | 2× AMD EPYC 9575F (64 jader, 3,3 GHz) |
| GPU | 8× AMD Instinct MI325X (256 GB HBM3E paměti každý, šířka pásma 6 TB/s), k dispozici v provedení s chlazením vzduchem nebo kapalinou |
| Síť | 2× AMD Pensando Pollara 400 Gb/s SmartNIC |
| Skříň | Supermicro AS-8126GS-TNMR, plně vyvalidovaná a připravená k instalaci do racku |
Systém je navržen jako zařízení, které „zapojíte do zásuvky, doslova zapnete a ono funguje“ .
Software od Spectro Cloud s názvem PaletteAI Inference Launchpad dělá z hardwaru skutečně užitečný nástroj. Poskytuje :
AMD a Spectro Cloud tvrdí, že platforma dokáže snížit náklady na tokeny pro AI kódování až o 70 % ve srovnání se scénářem, kdy jsou všechny požadavky odesílány do cloudových API . AMD ve svých materiálech uvádí, že návratnost kapitálové investice může být již za šest měsíců . Tato tvrzení nebyla nezávisle ověřena a skutečné úspory budou záviset na konkrétní skladbě úloh a cenách cloudových API .
Dan McNamara (SVP & GM, Compute & Enterprise AI, AMD):
„Organizace potřebují mít pod kontrolou, kde se kód zpracovává, které modely se používají a kolik to stojí. AMD Instinct Coder kombinuje vysoce výkonné AMD compute a otevřený softwarový ekosystém s technologiemi Supermicro a Spectro Cloud. Zákazníkům to dává jednoduchý způsob, jak provozovat více úloh lokálně, používat cloudové modely selektivně a sami spravovat infrastrukturu.“
Tenry Fu (spoluzakladatel a CEO, Spectro Cloud):
„Organizace by neměly být nuceny volit mezi možnostmi cloudových modelů a ekonomikou a kontrolou lokální inference.“
Vik Malyala (SVP, AI a Enterprise, Supermicro):
Role Supermicro zahrnuje předvalidaci, integraci do racku a kvalifikaci systému, což zkracuje cestu od dodaného hardwaru k produkční inferenci a snižuje komplexitu nasazení .
Platforma byla oficiálně představena na konferenci Ai4 2026 (4.–6. srpna v Las Vegas) . Reaguje na jasný firemní problém: s tím, jak organizace rozšiřují používání AI nástrojů pro kódování napříč vývojářskými týmy a automatizovanými workflow, rychle rostou náklady na tokeny. Prvním uživatelem je společnost BMC, která platformu nasadila pro své projekty Helix Agentic Engineering .
AMD Instinct Coder je prezentován jako řízená, lokální alternativa k čistě cloudovým asistentům pro kódování, která vyvažuje výkon, náklady a kontrolu pro firmy, které nemohou nebo nechtějí posílat svůj proprietární zdrojový kód do API třetích stran.