該平台採用分層式推理架構。AMD 的 EPYC CPU 與 Instinct GPU(整合在 Helios 機櫃內)負責處理提示詞前置處理、Token 化以及大型上下文視窗等前端階段。Cerebras 的 WSE 則接手最吃運算資源的階段——高速 Token 生成,這個階段需要極大的記憶體頻寬與平行處理吞吐量 。
這種「解構式」設計讓推理流程中的每個子任務都能在最適合的晶片上執行:AMD 提供低延遲的 CPU/GPU 邏輯負責通用階段,Cerebras 的晶圓級晶片則以龐大的平行運算火力投入核心模型執行 。AMD 執行長蘇姿丰(Lisa Su)形容,這項合作反映了業界正逐步轉向「用不同晶片處理推理流程不同階段」的趨勢 。
雙方宣稱,與傳統以 GPU 為主的推理方案相比,這個聯合平台能在複雜 AI 應用中顯著降低回應時間。官方說法稱其能提供「業界領先的超低延遲與高吞吐量 AI 推理」。不過,活動現場並未公布具體的評測數據(如每秒 Token 數或毫秒級延遲)。消息公布當日,Cerebras 股價上漲約 6% 。
這套聯合方案預計於 2026 下半年透過 Cerebras Cloud 提供。Cerebras 計畫在其資料中心內部部署 AMD Helios 系統,以此來託管服務 。
AMD 也在同場活動中正式發表 Helios——這是該公司首款機櫃級 AI 系統。執行長蘇姿丰稱其為「全球最強大的 AI 機櫃」,並確認已進入量產階段 。主要規格包括:
Helios 被定位為 Nvidia DGX 與 HGX 機櫃系統的直接競爭對手,AMD 宣稱其在 AI 訓練與推理工作負載上均擁有超越對手的效能 。
Advancing AI 2026 的核心主軸是:AI 推理市場正逐漸告別「單一 GPU 包辦一切」的模式,轉向解構式、按工作負載最佳化的架構——將前置處理、推理執行與後處理等任務,分配給不同廠商的專用晶片。AMD 將 Helios 與 Cerebras 的合作定位為一個多廠商、開放生態系的選擇,以此與 Nvidia 垂直整合的路線抗衡 。
除了 Cerebras 合作與 Helios 發表,AMD 還宣布了多項重要消息:
AMD 透露,在 Advancing AI 活動開始前(同一週)已與 Anthropic 簽下客戶合約。Anthropic 加入了承諾大規模部署 AMD 硬體(包含 Helios 系統)的頂尖 AI 實驗室行列,這也反映了主流 AI 公司正逐漸分散對 Nvidia GPU 的依賴 。
Cerebras 在與 AMD 合作之外,2026 年本身也動盪不斷。該公司於 2026 年 5 月 14 日在那斯達克掛牌,股票代號 CBRS。它以每股 185 美元的價格發行 3,000 萬股(遠高於原先預期的 115~125 美元區間),募資 55.5 億美元,成為 2026 年美國科技業最大 IPO。首日收盤價為 311.07 美元,漲幅達 68% 。
2026 年 1 月,OpenAI 與 Cerebras 宣布一項多年期合約,採購高達 750 百萬瓦(MW)的運算容量。最初報導的承諾金額約 100 億美元,隨後擴大到超過 200 億美元(潛在上限可達 300 億美元)。OpenAI 也據此獲得 Cerebras 最高 10% 的股權 。