【CNMO 科技消息】近日,据报道,英伟达公布了新一代 Vera Rubin 平台的最新进展。目前,面向 " 千兆级 AI 工厂 " 的 Vera Rubin 平台正在全球扩大部署,CoreWeave、谷歌云、微软 Azure 和甲骨文云等企业已经开始运行 Vera Rubin NVL72 系统。

英伟达 Vera Rubin 平台
英伟达方面表示,Vera Rubin NVL72 的生产正在加速,其供应链覆盖 30 个国家和地区的 350 多个生产基地。与上一代 Blackwell 平台相比,Vera Rubin 主要针对大规模模型训练、推理以及智能体 AI 负载进行优化,重点提升计算效率,并降低数据中心运行大型 AI 模型时的单位成本。
据 CNMO 科技了解,一套 Vera Rubin NVL72 系统集成 72 颗 Rubin GPU 和 36 颗 Vera CPU,并通过 NVLink 6 连接。英伟达称,该系统在运行大型混合专家模型时,所需 GPU 数量可降低至 Blackwell 平台的四分之一;推理吞吐量与功耗比最高提升 10 倍,每百万 Token 成本则可降至原来的十分之一。

英伟达 Vera CPU
在合作伙伴中,CoreWeave 已于今年 6 月完成 Vera Rubin NVL72 系统的部署和验证,成为首批将该平台投入云基础设施的企业之一。微软 Azure、谷歌云和甲骨文云也已开始运行相关系统。随着 Vera Rubin 进入规模化部署阶段,英伟达新一代 AI 计算平台正在从产品发布转向实际落地,其竞争重点也将由单颗芯片性能进一步转向整套 AI 基础设施的计算效率、能耗和部署成本。
版权所有,未经许可不得转载


登录后才可以发布评论哦
打开小程序可以发布评论哦