Розроблена спільно компаніями AMD, Supermicro та Spectro Cloud, платформа була представлена 5 серпня 2026 року на конференції Ai4 2026 у Лас-Вегасі . Ось як вона працює, скільки коштує та для кого призначена.
Основною відмінністю AMD Instinct Coder є інтелектуальна маршрутизація моделей на основі політик . Звичайні запити на кодування — генерація коду, рефакторинг, підсумовування — обробляються локально за допомогою оптимізованої AMD моделі GLM-5.2 (архітектура mixture-of-experts, 744 млрд параметрів, з яких активується близько 40 млрд на токен) . Складніші завдання, які потребують глибокого аналізу, можуть бути перенаправлені до зовнішніх моделей, таких як OpenAI GPT, Anthropic Claude або Google Gemini, якщо локальна модель не в змозі їх виконати . Саме така дворівнева архітектура інференції є ключовим механізмом для досягнення заявленої економії .
Еталонна система — це попередньо валідований, інтегрований у стійку пристрій, який постачається як єдиний SKU :
| Компонент | Специфікація |
|---|---|
| Процесори (CPU) | 2x AMD EPYC 9575F (64 ядра, 3.3 ГГц кожен) |
| Графічні прискорювачі (GPU) | 8x AMD Instinct MI325X (256 ГБ пам'яті HBM3E кожен, пікова пропускна здатність 6 ТБ/с), доступні в версіях з повітряним або рідинним охолодженням |
| Мережа | 2x AMD Pensando Pollara 400 Гбіт/с SmartNIC |
| Шасі | Supermicro AS-8126GS-TNMR, повністю валідоване та інтегроване в стійку |
Система позиціонується як пристрій, який потрібно просто "ввімкнути, і він працює", і буде доступна у вигляді одного SKU до кінця кварталу запуску .
Програмне забезпечення Spectro Cloud PaletteAI Inference Launchpad — це той шар, який робить апаратне забезпечення справді корисним. Воно забезпечує :
AMD та Spectro Cloud стверджують, що платформа може зменшити витрати на токени для AI-кодування до 70% порівняно з відправкою всіх запитів до хмарних API frontier-моделей . У власних матеріалах AMD йдеться про термін окупності капітальних інвестицій всього за шість місяців . Ці твердження не пройшли незалежної верифікації, і фактична економія залежатиме від характеру робочого навантаження, патернів використання та цін на хмарні API .
Ден МакНамара (SVP & GM, Compute & Enterprise AI, AMD):
"Організаціям потрібен контроль над тим, де обробляється код, які моделі використовуються та скільки це коштує. AMD Instinct Coder поєднує високопродуктивні обчислення AMD та відкриту програмну екосистему з технологіями Supermicro і Spectro Cloud, надаючи клієнтам простий спосіб виконувати більше роботи локально, використовувати frontier-моделі вибірково та самостійно керувати інфраструктурою."
Тенрі Фу (Співзасновник та CEO, Spectro Cloud):
"Організації не повинні обирати між можливостями frontier-моделей та економікою й контролем локального інференсу."
Вік Маляла (SVP, AI and Enterprise, Supermicro):
Роль Supermicro включає попередню валідацію, інтеграцію в стійки та кваліфікацію системи для зменшення складності розгортання та скорочення шляху від поставленого обладнання до виробничого інференсу .
Платформа була представлена на Ai4 2026 (4–6 серпня в Лас-Вегасі) . Її запуск є відповіддю на чітко визначену проблему підприємств: зі зростанням масштабів використання AI-агентів для кодування, витрати на токени стрімко зростають. Перший відомий користувач, компанія BMC, вже використовує платформу для своєї роботи з Helix Agentic Engineering .
AMD Instinct Coder позиціонується як керована, локальна альтернатива суто хмарним AI-помічникам для кодування, що дозволяє збалансувати продуктивність, вартість та контроль для підприємств, які не можуть або не хочуть передавати власний вихідний код третім особам.