快科技 9 月 1 日消息,天风国际证券分析师郭明錤近日发布的最新产业调查显示,英伟达已重启 Rubin CPX 芯片计划,预计 2027 年第一季度正式投产。
这款专为大规模长上下文 AI 推理与预填充阶段设计的全新 GPU 类别,最早于 2025 年 GTC 大会首次公开,原计划 2026 年底上市,后一度从产品蓝图中移除,如今重新回归。
据郭明錤报告,重启后的新版 CPX 在规格、机柜设计、互联架构、运作模式和产品定位五个维度均有重大调整,整体朝着更灵活、更具成本效益的方向演进。
CPX 是为了处理百万级 Token 的预填充及长上下文推理而设计的,采用 NVFP4 精度技术,单颗 GPU 提供 30 至 50 Petaflops 运算效能。旧版 CPX 原定搭载 128GB GDDR7 内存,成本更低但算力有限。
重启后的新版 CPX 改用 168GB HBM4 内存,低于 Rubin 标准版的 288GB HBM4,但大幅高于旧版的 128GB GDDR7。此外,单颗 GPU 最高功耗同为 2300W。
机柜设计方面,新版 CPX 采用独立 MGX ETL 机柜,不再与 Rubin 共柜。客户可根据需求配置 64、128、192 或 256 颗 CPX。每 64 颗 CPX 组成一个机柜模组,配置 8 个运算托盘(每托盘 8 颗 CPX)加 1 个交换机托盘。
互联架构上,NVLink 仅用于同一托盘内 8 颗 CPX 的 Scale-Up 互联,每颗 CPX 的 NVLink 带宽为 1 至 1.5TB/s,低于 Rubin 的 3.6TB/s。同一机柜模组内的托盘间通过 Spectrum-6 以太网进行 Scale-Out,跨机柜模组则通过 OSFP 光纤连接。
CPX 需与 Vera Rubin NVL72 搭配使用,英伟达建议 CPX 与 Rubin 的比例为 1:1。CPX 负责处理预填充并建立 KV Cache,再通过以太网 RDMA 传输给 Rubin 执行解码生成。
郭明錤指出,目前 AI 推理工作负载中超过一半来自处理输入内容并建立 KV Cache,CPX 以更灵活的部署方式和更低成本承接这一任务,每个运算托盘(8 颗 CPX)约配备 1.34TB HBM4,足以支撑大多数长上下文预填充与 KV Cache 建立需求。

【本文结束】如需转载请务必注明出处:快科技
责任编辑:红茶


登录后才可以发布评论哦
打开小程序可以发布评论哦