Hasty Briefsbeta

双语

AMD and Cerebras Launch AI Inference Solution

5 hours ago
  • AMD 与 Cerebras Systems 宣布了一项技术合作,共同推出一种全新的分解式 AI 推理解决方案。
  • 该解决方案将 AMD Helios 机架级系统与 Cerebras 晶圆级引擎相结合,以实现超低延迟和高吞吐量。
  • 与仅使用 Cerebras WSE 的配置相比,该联合解决方案预计每瓦每秒的令牌数(T/s/W)可提升高达5倍。
  • AMD Helios 提供高吞吐量的提示处理,而 Cerebras WSE 则以超低延迟加速内存带宽密集型的令牌生成。
  • 该解决方案通过异构基础设施应对日益多样化的 AI 推理工作负载。
  • Cerebras 计划在其数据中心部署 AMD Helios,并于2026年下半年通过 Cerebras Cloud 提供使用。