AMD攜手Cerebras押注低時延AI推理:每瓦每秒Token吞吐提升5倍

IT之家
07/24

IT之家 7 月 24 日消息,科技媒體 Wccftech 今天(7 月 24 日)發布博文,報道稱在 Advancing AI 2026 活動中,AMD 宣佈攜手 Cerebras 公司,聯合開發 AI 推理解決方案。

根據官方新聞稿,該方案主要針對超低延遲 AI 推理場景,將整合 AMD 的 Helios 機架級解決方案與 Cerebras 的晶圓級引擎,從而應對英偉達和 Groq 合作。

按照雙方披露的路線,Helios 機架承擔高性能、可擴展吞吐引擎角色,主要處理提示詞與大上下文窗口。

Cerebras 的 Wafer-Scale Engine 則負責對內存帶寬要求更高的 Token 生成與解碼環節,強調超低時延表現,結合使用 2 個計算引擎,預估可以將每瓦每秒 token 數量提高 5 倍。IT之家附上相關截圖如下:

Cerebras 介紹稱,Wafer-Scale Engine 在單塊互連硅片上無縫連接數十萬個計算核心和數十 GB 的 SRAM,減少外部網絡瓶頸對數據傳輸的影響。

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10