该平台由AMD、Supermicro和Spectro Cloud联合开发,于2026年8月5日在拉斯维加斯举行的Ai4 2026大会上发布。以下是它的工作原理、成本以及目标用户群。
AMD Instinct Coder的核心差异化优势在于其基于策略的智能模型路由功能。常规的编程请求——如代码生成、总结、重构——由本地一个AMD优化的GLM-5.2混合专家模型(总计7440亿参数,每个Token约激活400亿参数)提供服务。当本地模型无法处理时,复杂的推理查询可以转发给OpenAI GPT、Anthropic Claude或Google Gemini等前沿模型。这种分层推理设计正是其宣称能够节省成本的核心机制。
参考系统是一个经过预验证、集成上架的一体化设备,作为一个单一SKU出货:
| 组件 | 规格 |
|---|---|
| CPU | 2颗AMD EPYC 9575F处理器(各64核心,3.3 GHz) |
| GPU | 8块AMD Instinct MI325X加速器(各256 GB HBM3E显存,峰值带宽6 TB/s),提供风冷或液冷型号 |
| 网络 | 2块AMD Pensando Pollara 400 Gb/s智能网卡 |
| 机箱 | Supermicro AS-8126GS-TNMR,完全验证并集成上架 |
该系统被设计成一种“插电即用”的一体化设备,在其发布季度末即可作为单一SKU订购。
Spectro Cloud的PaletteAI Inference Launchpad是让硬件发挥作用的软件层。它提供:
AMD和Spectro Cloud声称,与将所有请求发送到基于云端的前沿模型API相比,该平台可以将AI编程的Token成本降低高达70%。AMD自己的资料中提到,资本投资的回收期可短至六个月。这些说法尚未得到独立验证,实际节省取决于组织的工作负载组合、使用模式和云API定价。
Dan McNamara(AMD高级副总裁兼计算与企业AI总经理):
“组织需要控制代码在哪里处理、使用哪些模型以及使用成本是多少。AMD Instinct Coder结合了高性能的AMD计算和开放的软件生态系统,并与Supermicro和Spectro Cloud的技术相融合,为客户提供了一种简单的方式,可以在本地运行更多工作负载,有选择地使用前沿模型,并自行运营基础设施。”
Tenry Fu(Spectro Cloud联合创始人兼CEO):
“组织不应被迫在前沿模型的能力与本地推理的经济性和控制力之间做出抉择。”
Vik Malyala(Supermicro AI与企业高级副总裁):
Supermicro的角色包括预验证、机架集成和系统认证,以降低部署复杂性并缩短从硬件交付到生产推理的路径。
该平台是在Ai4 2026(8月4日至6日,拉斯维加斯)上发布的。此次发布回应了企业的一个明确痛点:随着组织在开发团队和自动化工作流程中扩展AI编程智能体,Token成本正在迅速上升。早期采用者BMC已经在其Helix Agentic Engineering工作中部署了该平台。
AMD Instinct Coder被定位为一种受治理的本地部署替代方案,以替代纯云端的编程助手,为那些不能或不愿将专有源代码发送给第三方API的企业在能力、成本和控制之间取得平衡。