呢個平台嘅運作係分層進行嘅。AMD 嘅 EPYC CPU 同 Instinct GPU(即係 Helios 機架系統裏面嘅硬件)負責前端工作:包括提示預處理、標記化(Tokenization)同大型上下文窗口處理。做完呢啲步驟之後,就輪到 Cerebras 嘅 WSE 出場,處理最需要運算力嘅部分——快速 Token 生成,呢個步驟需要極大嘅記憶體頻寬同平行處理能力 。
換句話講,每個推論嘅子任務都行喺最適合嘅晶片上面。AMD 提供低延遲嘅 CPU/GPU 邏輯處理通用階段,而 Cerebras 嘅晶圓級晶片就負責核心模型執行嘅大規模平行運算 。AMD CEO Lisa Su 形容呢個合作係緊整個行業轉向「用唔同晶片處理推論管線入面唔同階段」嘅一大體現 。
兩間公司聲稱,相比傳統嘅單體 GPU 推論方案,呢個聯合平台可以大幅降低複雜 AI 應用嘅回應時間。官方嘅講法係可以做到「業界領先嘅超低延遲同高吞吐量 AI 推論」。不過,活動當日未有公布具體嘅基準測試數字,例如每秒 Token 數或者延遲時間以毫秒計。消息公布當日,Cerebras 嘅股價升咗大約 6% 。
呢個聯合方案預計會喺 2026 年下半年透過 Cerebras Cloud 推出。Cerebras 計劃喺自己嘅數據中心部署 AMD Helios 系統嚟提供服務 。
AMD 喺同一活動上亦正式推出咗 Helios,係佢哋第一款機架級 AI 系統。CEO Lisa Su 叫佢做「世上最強大嘅 AI 機架」,並確認已經全面量產 。主要規格包括:
Helios 嘅定位係直接挑戰 Nvidia 嘅 DGX 同 HGX 機架系統,AMD 聲稱無論喺 AI 訓練定係推論方面都表現更佳 。
Advancing AI 2026 嘅核心訊息係:AI 推論市場正逐步脫離「單一 GPU 做晒所有階段」嘅模式。取而代之嘅係拆解式、工作負載最佳化嘅架構,將預處理、推論執行同後期處理分散喺唔同廠商嘅專用晶片上。AMD 用 Helios 同 Cerebras 合作作為例子,展示咗一個多廠商、開放生態系統嘅方案,對抗 Nvidia 嘅垂直整合策略 。
除咗 Cerebras 合作同 Helios 推出之外,AMD 仲有幾個重要公布:
AMD 透露喺 Advancing AI 活動同一周較早前,已經同 Anthropic 達成客戶協議。Anthropic 加入咗主要 AI 實驗室嘅行列,承諾大規模部署 AMD 硬件(包括 Helios 系統),反映咗頂尖 AI 公司正逐步分散供應鏈,減少對 Nvidia GPU 嘅依賴 。
Cerebras 喺 2026 年 5 月 14 日喺納斯達克上市,股票代號 CBRS。佢哋以每股 185 美元嘅價格發行 3,000 萬股,遠高於最初預期嘅 115 至 125 美元區間,集資 55.5 億美元,係 2026 年最大嘅美國科技股 IPO。首日股價飆升 68%,收報 311.07 美元 。
另外,OpenAI 同 Cerebras 喺 2026 年 1 月宣布咗一份多年期協議,涉及高達 750 兆瓦嘅運算容量。最初承諾嘅金額大約係 100 億美元,後來擴大至超過 200 億美元(潛在上限 300 億美元)。報導亦指 OpenAI 獲得了 Cerebras 最多 10% 嘅股權作為交易一部分 。