IT之家 7 月 24 日消息,科技媒體 Wccftech 今天(7 月 24 日)發布博文,報道稱在 Advancing AI 2026 活動中,AMD 宣佈攜手 Cerebras 公司,聯合開發 AI 推理解決方案。

根據官方新聞稿,該方案主要針對超低延遲 AI 推理場景,將整合 AMD 的 Helios 機架級解決方案與 Cerebras 的晶圓級引擎,從而應對英偉達和 Groq 合作。

按照雙方披露的路線,Helios 機架承擔高性能、可擴展吞吐引擎角色,主要處理提示詞與大上下文窗口。
Cerebras 的 Wafer-Scale Engine 則負責對內存帶寬要求更高的 Token 生成與解碼環節,強調超低時延表現,結合使用 2 個計算引擎,預估可以將每瓦每秒 token 數量提高 5 倍。IT之家附上相關截圖如下:


Cerebras 介紹稱,Wafer-Scale Engine 在單塊互連硅片上無縫連接數十萬個計算核心和數十 GB 的 SRAM,減少外部網絡瓶頸對數據傳輸的影響。