科技资讯网 4小时前
AMD和Cerebras发布业界领先的兼具超低延迟和超高吞吐量的AI推理解决方案
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

新闻要点

AMD 和 Cerebras 正在合作开发针对超低延迟 AI 推理基础设施的工作负载优化方案。

AMD Helios 和 Cerebras 晶圆级引擎(Cerebras Wafer-Scale Engine)将作为一个单一的解耦推理工作流运行,将 AMD Instinct GPU 的超高吞吐能力与 Cerebras 晶圆级引擎的超快 token 生成能力相结合。

Cerebras 计划在其数据中心部署 AMD Helios,该联合解决方案预计将于 2026 年下半年率先通过 Cerebras Cloud 提供。

2026 年 7 月 23 日,加利福尼亚州旧金山和森尼韦尔讯 – AMD(纳斯达克股票代码:AMD)与 Cerebras System(纳斯达克股票代码:CBRS)宣布建立技术合作伙伴关系,并将推出一款结合 AMD Helios 机架级解决方案和 Cerebras 晶圆级引擎的全新解耦式 AI 推理解决方案。该解决方案在 Advancing AI 2026 峰会上首次亮相,旨在为最先进的 AI 应用提供所需的超低延迟,同时大幅提升吞吐量和效率。

AMD 与 Cerebras 的联合解决方案将 AMD Helios 与 Cerebras 晶圆级引擎整合到单一的推理工作流中,以实现性能和效率的最大化。AMD Helios 将提供一个高性能、可扩展的吞吐量引擎。而 Cerebras 晶圆级引擎技术将带来超快、超低延迟的解码和 token 生成能力。在 2026 年 7 月采用 Kimi 2.6 1T 大模型作为工作负载的模拟测试中,在相同交互体验水平下,这两大计算引擎的结合相较于纯 Cerebras WSE 架构,预计可实现最高 5 倍的每瓦每秒 ( T/s/W ) token 数。

AI 推理工作负载在延迟、吞吐量、token 容量、成本和规模等方面正日益呈现出不同需求。高容量工作负载优先考虑最大化 token 生成,而编码、实时 copilots、在线代理和智能体工作负载则需要更快地响应时间。这些差异正在推动对异构基础设施的需求,使计算技术能够根据特定的工作负载需求相匹配。

AMD 与 Cerebras 的解决方案利用解耦式推理来解决这一挑战,独立优化工作流中的两个主要阶段。AMD Helios 提供超高吞吐量,可处理提示词和大型上下文窗口。Cerebras 晶圆级引擎则以超低延迟加速内存带宽密集的 token 生成。通过在一个集成式的工作流中连接这些领先的引擎,两家公司正在打造一个能够实现超低延迟推理且不会牺牲吞吐量或扩展性的差异化平台。

AMD 董事会主席及首席执行官苏姿丰博士(Dr. Lisa Su)认为:"AI 推理正在成为 AI 领域中最大的基础设施机遇之一,其需要采取更灵活的方法来满足日益增长的多样性。AMD Helios 可为更广泛的推理工作负载提供领先的性能和可扩展性。通过与 Cerebras 合作,我们正在将这一领先优势延伸至那些更为延迟敏感的应用领域中,同时为实时智能体 AI 打造一个强大的全新平台。"

Cerebras 首席执行官及联合创始人 Andrew Feldman 表示:" 对于超快推理的需求正在以前所未有的速度增长。Cerebras 提供了全球更快且具备超低延迟的推理能力。与 AMD 的合作为我们提供了一个令人难以置信的机会,以将这种性能带给更多客户。"

随着 AI 逐渐应用于软件开发、自主智能体、机器人、科学发现及其他响应时间会直接影响客户体验和系统实用性的应用领域中,快速 token 生成能力正在变得越来越重要。这一联合解决方案将互补的架构整合在一起,旨在满足这些需求。

AMD Helios 提供了能够处理大量复杂请求所需的高吞吐量提示引擎、机架级效率和部署规模。Cerebras 晶圆级引擎则为实时返回 token 带来所需的超低延迟和解码性能。由此打造的解决方案旨在为推理市场中的超低延迟而设计,其中 AMD Helios 作为基础,能够在整个数据中心中实现高吞吐量并平衡推理工作负载。

Cerebras 计划在其数据中心部署 AMD Helios,该联合解决方案预计将于 2026 年下半年率先通过 Cerebras Cloud 提供。

支持资源:

关注 AMD 在 Advancing AI 2026 峰会上的产品发布

详细了解 AMD Helios 机架级解决方案

详细了解 AMD Instinct 加速器

详细了解 Cerebras 晶圆级引擎

关于Cerebras Systems

Cerebras Systems(纳斯达克代码:CBRS)构建了全球更快的 AI 基础设施。Cerebras 的团队由开创性的计算机架构师、计算机科学家、AI 研究人员以及各类工程师组成,他们通过创新与发明让 AI 的速度实现突破式提升。我们相信,当 AI 足够快速时,它将改变世界。全球领先的企业、研究机构均选择 Cerebras 来运行其 AI 工作负载。Cerebras 的解决方案可在本地部署,也可通过云端使用。详细了解 Cerebras 请访问 cerebras.ai。

关于AMD

AMD(纳斯达克代码:AMD)致力于推动高性能和人工智能计算创新,助力应对全球重大挑战。如今,AMD 的技术驱动数十亿应用体验,广泛用于云和人工智能基础设施、嵌入式系统、AI PC 及游戏领域。凭借一系列面向人工智能优化的 CPU、GPU、网络技术及软件的丰富产品组合,AMD 提供全栈式人工智能解决方案,为智能计算新时代带来所需的卓越性能与可扩展性。更多信息,敬请访问 AMD 公司官网 www.amd.com

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

amd 吞吐量 ai 晶圆 基础设施
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论