呢個平台由 AMD、Supermicro 同 Spectro Cloud 聯手開發,2026 年 8 月 5 日喺拉斯維加斯嘅 Ai4 2026 大會正式公布 。以下係佢嘅運作原理、成本效益同適合咩企業用。
AMD Instinct Coder 最核心嘅賣點係 基於政策嘅智能模型路由。日常嘅編碼請求 — 例如產生 code、總結、重構 — 會由一個 AMD 優化嘅 GLM-5.2 mixture-of-experts 模型(總共 744B 參數,每次 token 大約啟動 40B)喺本地處理 。複雜啲嘅推理問題,如果本地模型搞唔掂,就會自動轉去 OpenAI GPT、Anthropic Claude 或 Google Gemini 呢啲 frontier 模型 。呢種分層推理設計,就係聲稱可以大幅節省成本嘅背後原理 。
呢個參考系統係一部預先驗證、整合好晒嘅機架設備,以單一 SKU 出貨,即插即用 :
| 組件 | 規格 |
|---|---|
| CPU | 2 粒 AMD EPYC 9575F 處理器(每粒 64 核、3.3 GHz) |
| GPU | 8 張 AMD Instinct MI325X 加速卡(每張 256 GB HBM3E 記憶體、峰值頻寬 6 TB/s),有風冷同水冷兩種選擇 |
| 網絡 | 2 張 AMD Pensando Pollara 400 Gb/s SmartNIC |
| 機箱 | Supermicro AS-8126GS-TNMR,經過全面驗證同機架整合 |
AMD 形容呢部機嘅設計係「插電、開機,就即刻用得」,預計喺推出季度內可以以單一 SKU 訂購 。
Spectro Cloud 嘅 PaletteAI Inference Launchpad 係令硬件發揮作用嘅軟件層,提供以下功能 :
AMD 同 Spectro Cloud 聲稱,相比全部請求都經雲端 frontier 模型 API,呢個方案可以 將 AI 編碼 token 成本降低最多 70%。AMD 自己嘅資料仲話,資本投資嘅回本期可以短至 六個月。不過,呢啲數字暫時未經獨立驗證,實際可以慳到幾多,要視乎每間公司嘅工作負載組合、使用模式同雲端 API 嘅收費而定 。
Dan McNamara(AMD 高級副總裁兼總經理,運算及企業 AI):
「企業需要控制代碼喺邊度處理、用邊啲模型、同成本係幾多。AMD Instinct Coder 結合咗高效能 AMD 運算、開放軟件生態圈、Supermicro 同 Spectro Cloud 技術,畀客戶一個簡單嘅方法,可以喺本地做更多工作、選擇性使用 frontier 模型,同自己營運基建。」
Tenry Fu(Spectro Cloud 聯合創辦人兼 CEO):
「企業唔應該要喺 frontier 模型嘅能力同本地推理嘅經濟效益同控制權之間二揀一。」
Vik Malyala(Supermicro 高級副總裁,AI 及企業業務):
Supermicro 嘅角色包括預先驗證、機架整合同系統鑑定,以降低部署複雜性,縮短由硬件送到手到正式生產推理嘅時間 。
呢個平台喺 Ai4 2026(8 月 4 至 6 日,拉斯維加斯)亮相 。推出嘅時機正正回應咗企業嘅痛點:隨住越嚟越多開發團隊同自動化流程用 AI 編碼 agent,token 成本急速上升。早期採用者 BMC 已經將呢個平台用喺佢哋嘅 Helix Agentic Engineering 工作上 。
AMD Instinct Coder 定位係一個有管治、放喺公司機房嘅替代方案,同純雲端嘅編碼助手打對台,喺能力、成本同控制權之間取得平衡,特別適合唔能夠或唔想將 proprietary 源碼送去第三方 API 嘅企業使用。