AMD 與 Cerebras 宣布技術合作,推出分離式 AI 推理平台,由 AMD Helios 機櫃基礎設施搭配 Cerebras 晶圓級引擎(WSE),針對推論流程不同階段採用最佳化晶片。 架構上由 AMD EPYC CPU 與 Instinct GPU 負責提示詞前置處理與大型上下文視窗,Cerebras 的 WSE 則專注於最吃運算的 Token 生成環節,反應了業界走向「解構式、按工作負載最佳化」的設計趨勢。

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What did AMD and Cerebras announce at AMD's Advancing AI 2026 event regarding a joint AI inferenc. Article summary: Here is a comprehensive, sourced breakdown of what was announced at AMD's Advancing AI 2026 event on July 23, 2026 in San Francisco.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it usefu
在 2026 年 7 月 23 日於舊金山舉辦的 Advancing AI 2026 大會上,AMD 與 AI 晶片新創 Cerebras 宣布了一項技術合作,共同打造新型態的 AI 推理平台。這套解決方案跳脫傳統單一 GPU 架構的框架,將 AMD 全新發表的 Helios 機櫃系統與 Cerebras 的晶圓級引擎(WSE)結合,採用「分離式、按工作負載最佳化」的設計 。
該平台採用分層式推理架構。AMD 的 EPYC CPU 與 Instinct GPU(整合在 Helios 機櫃內)負責處理提示詞前置處理、Token 化以及大型上下文視窗等前端階段。Cerebras 的 WSE 則接手最吃運算資源的階段——高速 Token 生成,這個階段需要極大的記憶體頻寬與平行處理吞吐量 。
這種「解構式」設計讓推理流程中的每個子任務都能在最適合的晶片上執行:AMD 提供低延遲的 CPU/GPU 邏輯負責通用階段,Cerebras 的晶圓級晶片則以龐大的平行運算火力投入核心模型執行 。AMD 執行長蘇姿丰(Lisa Su)形容,這項合作反映了業界正逐步轉向「用不同晶片處理推理流程不同階段」的趨勢
。
雙方宣稱,與傳統以 GPU 為主的推理方案相比,這個聯合平台能在複雜 AI 應用中顯著降低回應時間。官方說法稱其能提供「業界領先的超低延遲與高吞吐量 AI 推理」。不過,活動現場並未公布具體的評測數據(如每秒 Token 數或毫秒級延遲)。消息公布當日,Cerebras 股價上漲約 6%
。
這套聯合方案預計於 2026 下半年透過 Cerebras Cloud 提供。Cerebras 計畫在其資料中心內部部署 AMD Helios 系統,以此來託管服務 。
AMD 也在同場活動中正式發表 Helios——這是該公司首款機櫃級 AI 系統。執行長蘇姿丰稱其為「全球最強大的 AI 機櫃」,並確認已進入量產階段 。主要規格包括:
Helios 被定位為 Nvidia DGX 與 HGX 機櫃系統的直接競爭對手,AMD 宣稱其在 AI 訓練與推理工作負載上均擁有超越對手的效能 。
Advancing AI 2026 的核心主軸是:AI 推理市場正逐漸告別「單一 GPU 包辦一切」的模式,轉向解構式、按工作負載最佳化的架構——將前置處理、推理執行與後處理等任務,分配給不同廠商的專用晶片。AMD 將 Helios 與 Cerebras 的合作定位為一個多廠商、開放生態系的選擇,以此與 Nvidia 垂直整合的路線抗衡 。
除了 Cerebras 合作與 Helios 發表,AMD 還宣布了多項重要消息:
AMD 透露,在 Advancing AI 活動開始前(同一週)已與 Anthropic 簽下客戶合約。Anthropic 加入了承諾大規模部署 AMD 硬體(包含 Helios 系統)的頂尖 AI 實驗室行列,這也反映了主流 AI 公司正逐漸分散對 Nvidia GPU 的依賴 。
Cerebras 在與 AMD 合作之外,2026 年本身也動盪不斷。該公司於 2026 年 5 月 14 日在那斯達克掛牌,股票代號 CBRS。它以每股 185 美元的價格發行 3,000 萬股(遠高於原先預期的 115~125 美元區間),募資 55.5 億美元,成為 2026 年美國科技業最大 IPO。首日收盤價為 311.07 美元,漲幅達 68% 。
2026 年 1 月,OpenAI 與 Cerebras 宣布一項多年期合約,採購高達 750 百萬瓦(MW)的運算容量。最初報導的承諾金額約 100 億美元,隨後擴大到超過 200 億美元(潛在上限可達 300 億美元)。OpenAI 也據此獲得 Cerebras 最高 10% 的股權 。
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
AMD 與 Cerebras 宣布技術合作,推出分離式 AI 推理平台,由 AMD Helios 機櫃基礎設施搭配 Cerebras 晶圓級引擎(WSE),針對推論流程不同階段採用最佳化晶片。
AMD 與 Cerebras 宣布技術合作,推出分離式 AI 推理平台,由 AMD Helios 機櫃基礎設施搭配 Cerebras 晶圓級引擎(WSE),針對推論流程不同階段採用最佳化晶片。 架構上由 AMD EPYC CPU 與 Instinct GPU 負責提示詞前置處理與大型上下文視窗,Cerebras 的 WSE 則專注於最吃運算的 Token 生成環節,反應了業界走向「解構式、按工作負載最佳化」的設計趨勢。
該聯合方案預計 2026 下半年透過 Cerebras Cloud 提供服務,Cerebras 將在其資料中心部署 AMD Helios 系統。