此平台由 AMD、Supermicro 與 Spectro Cloud 三方共同開發,於 2026 年 8 月 5 日在拉斯維加斯舉行的 Ai4 2026 大會上正式發布。以下將詳細介紹其運作方式、成本效益與適用對象。
AMD Instinct Coder 的核心差異化優勢在於其 基於政策的智慧模型路由 機制。一般的程式碼處理請求——例如程式碼生成、摘要、重構——會由本機端一個經 AMD 優化的 GLM-5.2 混合專家模型 來處理(該模型擁有 744B 總參數,每次推論約啟動 40B 參數)。當本地模型無法勝任複雜的推理查詢時,平台可將請求轉送至 OpenAI GPT、Anthropic Claude 或 Google Gemini 等前沿模型。這種分層式的推論設計,正是其所宣稱成本節省的核心機制。
參考系統是一個經過預先驗證、機架整合的設備,以單一 SKU 形式出貨:
| 組件 | 規格 |
|---|---|
| CPU | 2 顆 AMD EPYC 9575F 處理器(各 64 核心,3.3 GHz) |
| GPU | 8 顆 AMD Instinct MI325X 加速器(各 256 GB HBM3E 記憶體,峰值頻寬 6 TB/s),可選擇氣冷或液冷版本 |
| 網路 | 2 張 AMD Pensando Pollara 400 Gb/s SmartNIC |
| 機箱 | Supermicro AS-8126GS-TNMR,已完整驗證並整合至機架 |
此系統被設計為一部「即插即用」的設備,預計於發布季度末以單一 SKU 形式供貨。
Spectro Cloud 的 PaletteAI Inference Launchpad 是讓硬體發揮價值的軟體層,它提供了以下功能:
AMD 與 Spectro Cloud 宣稱,與將所有請求發送至雲端前沿模型 API 相比,此平台可 將 AI 程式碼代幣成本降低高達 70%。AMD 的官方資料更指出,該資本投資的最短回收期僅需 六個月。需要強調的是,這些宣稱尚未經獨立驗證,實際節省金額將取決於組織的工作負載組合、使用模式以及雲端 API 的定價。
Dan McNamara(AMD 資深副總裁暨運算與企業 AI 總經理):
「組織需要掌控程式碼的處理位置、使用的模型以及相關成本。AMD Instinct Coder 結合了高效能的 AMD 運算、開放軟體生態系,以及 Supermicro 和 Spectro Cloud 的技術,為客戶提供一條簡單的道路,讓他們能在本地運行更多工作負載,選擇性地使用前沿模型,並自行營運基礎設施。」
Tenry Fu(Spectro Cloud 共同創辦人暨執行長):
「組織不應該被迫在『前沿模型的能力』與『本地推論的經濟效益與掌控權』之間做出取捨。」
Vik Malyala(Supermicro 資深副總裁,AI 與企業業務):
Supermicro 的角色包括預先驗證、機架整合與系統認證,以降低部署複雜性,並縮短從硬體交貨到投入生產推論的時間。
此平台在 Ai4 2026(8 月 4 日至 6 日於拉斯維加斯舉行)上亮相。此次發布回應了一個明確的企業痛點:隨著企業在開發團隊與自動化工作流程中擴展 AI 程式碼代理,代幣成本正急遽上升。早期採用者 BMC 已將其平台部署於 Helix Agentic Engineering 工作中。
AMD Instinct Coder 的定位是一個有治理能力、就地部署的替代方案,用以取代純雲端程式碼輔助工具,在能力、成本與控制三方面取得平衡,特別適合那些不願或無法將專有原始碼傳送至第三方 API 的企業。