AMD携手Cerebras押注低时延AI推理:每瓦每秒Token吞吐提升5倍

IT之家
07/24

IT之家 7 月 24 日消息,科技媒体 Wccftech 今天(7 月 24 日)发布博文,报道称在 Advancing AI 2026 活动中,AMD 宣布携手 Cerebras 公司,联合开发 AI 推理解决方案。

根据官方新闻稿,该方案主要针对超低延迟 AI 推理场景,将整合 AMD 的 Helios 机架级解决方案与 Cerebras 的晶圆级引擎,从而应对英伟达和 Groq 合作。

按照双方披露的路线,Helios 机架承担高性能、可扩展吞吐引擎角色,主要处理提示词与大上下文窗口。

Cerebras 的 Wafer-Scale Engine 则负责对内存带宽要求更高的 Token 生成与解码环节,强调超低时延表现,结合使用 2 个计算引擎,预估可以将每瓦每秒 token 数量提高 5 倍。IT之家附上相关截图如下:

Cerebras 介绍称,Wafer-Scale Engine 在单块互连硅片上无缝连接数十万个计算核心和数十 GB 的 SRAM,减少外部网络瓶颈对数据传输的影响。

免责声明:投资有风险,本文并非投资建议,以上内容不应被视为任何金融产品的购买或出售要约、建议或邀请,作者或其他用户的任何相关讨论、评论或帖子也不应被视为此类内容。本文仅供一般参考,不考虑您的个人投资目标、财务状况或需求。TTM对信息的准确性和完整性不承担任何责任或保证,投资者应自行研究并在投资前寻求专业建议。

热议股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10