Платформа, совместно разработанная AMD, Supermicro и Spectro Cloud, была анонсирована 5 августа 2026 года на конференции Ai4 2026 в Лас-Вегасе . Разберёмся, как она работает, сколько стоит и для кого предназначена.
Ключевое отличие AMD Instinct Coder — политико-ориентированная интеллектуальная маршрутизация моделей . Рутинные задачи кодинга — генерация кода, рефакторинг, написание комментариев — обрабатываются локально с помощью оптимизированной AMD модели GLM-5.2 (архитектура mixture-of-experts, 744 млрд параметров, около 40 млрд активируется на токен) . Более сложные запросы, требующие глубоких рассуждений, могут быть перенаправлены на frontier-модели, такие как OpenAI GPT, Anthropic Claude или Google Gemini, когда локальная модель не справляется . Именно этот многоуровневый подход к выводу и лежит в основе заявленной экономии .
Референсная система представляет собой предварительно проверенное стоечное устройство, которое поставляется как единый SKU :
| Компонент | Характеристика |
|---|---|
| Процессоры | 2× AMD EPYC 9575F (64 ядра, 3,3 ГГц) |
| GPU | 8× AMD Instinct MI325X (256 ГБ HBM3E каждый, пиковая пропускная способность 6 ТБ/с), доступны в вариантах с воздушным или жидкостным охлаждением |
| Сеть | 2× AMD Pensando Pollara 400 Гбит/с SmartNIC |
| Корпус | Supermicro AS-8126GS-TNMR, полностью проверен и интегрирован в стойку |
Систему описывают как устройство, которое нужно «просто включить в розетку, буквально включить, и оно работает». Оно будет доступно для заказа как единый SKU до конца квартала запуска .
PaletteAI Inference Launchpad от Spectro Cloud — это программная прослойка, которая превращает «железо» в рабочий инструмент. Она предоставляет :
AMD и Spectro Cloud утверждают, что платформа может сократить затраты на токены для ИИ-кодинга до 70% по сравнению с отправкой всех запросов в облачные API frontier-моделей . В собственных материалах AMD приводится срок окупаемости капитальных вложений — шесть месяцев . Эти заявления не были независимо подтверждены, и фактическая экономия будет зависеть от структуры рабочей нагрузки организации, паттернов использования и цен на облачные API .
Дэн Макнамара (SVP & GM, Compute & Enterprise AI, AMD):
«Организациям нужен контроль над тем, где обрабатывается код, какие модели используются и сколько это стоит. AMD Instinct Coder объединяет высокопроизводительные вычисления AMD и открытую программную экосистему с технологиями Supermicro и Spectro Cloud, предоставляя клиентам простой способ выполнять больше задач локально, выборочно использовать frontier-модели и самостоятельно управлять инфраструктурой.»
Тенри Фу (Сооснователь и CEO Spectro Cloud):
«Организации не должны выбирать между возможностями frontier-моделей и экономикой и контролем локального вывода.»
Вик Маляла (SVP, AI and Enterprise, Supermicro):
Роль Supermicro включает предварительную проверку, интеграцию в стойку и квалификацию системы для снижения сложности развёртывания и сокращения пути от поставки оборудования до промышленного вывода .
Платформа была представлена на Ai4 2026 (4–6 августа в Лас-Вегасе) . Запуск стал ответом на очевидную корпоративную боль: по мере того как организации масштабируют ИИ-агентов кодинга среди команд разработки и автоматизированных рабочих процессов, расходы на токены быстро растут. Ранний пользователь BMC уже развернул платформу для своей работы Helix Agentic Engineering .
AMD Instinct Coder позиционируется как управляемая локальная альтернатива чистым облачным помощникам кодинга, обеспечивающая баланс между производительностью, стоимостью и контролем для предприятий, которые не могут или не хотят отправлять собственный исходный код сторонним API.