新浪财经 20小时前
郭明錤:英伟达已重启Rubin CPX项目 将于2027年第一季度开始生产
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

知名分析师郭明錤发文表示,就在市场已经开始相信 Rubin CPX 已被英伟达从产品路线图中剔除之际,其最新的产业调研显示,英伟达已重启该项目,预计将于2027 年第一季度(1Q27)开始生产。与先前设计相比,重启后的 Rubin CPX 提供更强的预填充(prefill)性能,并对 GPU 规格与机架架构均作出重大改动,凸显出英伟达对预填充解决方案的高度重视。

主要变动如下:

1.Rubin CPX GPU 规格  CPX 提供接近 Rubin 的计算性能,并匹配 Rubin 每颗 GPU 最高 2,300 瓦的额定功耗上限。CPX 改用 168GB 的 HBM4(Rubin 为 288GB,此前 CPX 设计为 128GB 的 GDDR7)。

2.机架设计  新版 CPX 采用独立的 MGXETL 机架,而非此前设计中与 Rubin 共用机架。客户可根据需求选择 64、128、192 或 256 颗 CPX GPU。在单个 CPX 机架内,每 64 颗 CPX GPU 构成一个机架模块(rack module),该模块由八个计算托盘(每个托盘 8 颗 CPX GPU)和一个交换托盘组成。

3.纵向扩展与横向扩展  NVLink 仅用于每个托盘内 8 颗 CPX GPU 之间的纵向扩展(scale-up),每颗 CPX 的 NVLink 带宽为 1 – 1.5TB/s(相比之下,每颗 Rubin 为 3.6TB/s)。每个机架模块内各托盘之间的横向扩展(scale-out)通过 Spectrum-6 以太网运行,采用全铜 L1 链路。跨机架模块的横向扩展则由各模块的 Spectrum-6 交换机经 OSFP 光链路处理。

4.工作原理  CPX 必须与 Vera Rubin NVL72 搭配使用,英伟达建议 CPX 与 Rubin GPU 按 1:1 的比例配置。CPX 负责预填充并构建 KV 缓存,随后通过以太网 RDMA 将 KV 缓存传输给 Rubin 进行解码(decode)。

5.产品定位:长上下文预填充场景下的单位成本最佳性能  如今超过 50% 的 AI 推理工作负载来自对输入上下文的处理及相应 KV 缓存的构建。因此,CPX 提供了一种更灵活、成本更低的预填充处理方式。每个八颗 CPX 的托盘拥有约 1.34TB 的 HBM4,足以满足大多数长上下文预填充工作负载及相应的 KV 缓存需求。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

英伟达 ai gpu 以太网
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论