在 AMD "Advancing AI 2026" 大会前夕,英伟达抢先公布了数据中心 CPU 产品 Vera 的更多技术细节。
这不仅是英伟达继 Grace 之后在 CPU 领域的又一重磅落子,更是其从 " 卖显卡 " 向 " 卖 AI 工厂 " 垂直整合战略的彻底摊牌——
Vera 是全球首款从核心层面专为代理式 AI(Agentic AI)量身定制的处理器。
英伟达还透露,Vera Rubin NVL72 已进入量产爬坡阶段,该平台的供应链覆盖了全球 350 多个工厂、30 个国家,超过 300 家合作伙伴参与其中。
Olympus 架构细节全公开
当地时间 7 月 21 日,英伟达发布博文,从技术角度详细介绍了 Vera CPU。
文中指出,智能体 AI(Agentic AI)将更多关键执行路径转移到了 CPU 上。
智能体(Agents)在沙箱中运行代码、调用工具、检索上下文、与数据库交互并分析结果,然后再将信息返回给模型。
这一过程意味着,CPU 不再只是 " 辅助加速器 ",而是成为了 AI 工厂中控制密集型循环的核心执行者。
智能体 AI 工作负载主要依赖于:
即使插槽满载,单线程性能依然强劲;
每个核心拥有足够的内存带宽,以保证多个活跃执行上下文的数据;
并发下延迟可预测,以便智能体能够稳定完成预定步骤;
高效处理不规则控制流、长依赖链和指针密集的数据结构。
英伟达强调,Vera CPU 围绕智能体 AI 负载设计,重点提升满负载条件下的单线程表现,设计核心是Olympus 核心。
为了应对智能体复杂的分支预测挑战,Olympus 核心引入了一个关键的黑科技:神经分支预测器(Neural Branch Predictor)。
配合 10-wide 的解码引擎,它能高效处理智能体运行时的复杂逻辑。
单颗 Vera 集成了 88 个这样的核心,支持 176 个线程,但设计重心明显偏向 " 宽发射、深流水线 "。
此外,Vera 也是首款在 CPU 核心中支持 FP8 精度的处理器,进一步打通了与 GPU 之间的数值计算壁垒。

除了算力,内存带宽往往是智能体并发执行的隐形杀手。
Vera 采用了创新的 SOCAMM2 LPDDR5X 内存方案,实现了 1.2TB/s 的惊人带宽。
这是传统 DDR5 服务器的两倍,而功耗却不到后者的一半。

在测试中,Vera 能维持 90% 的峰值带宽,确保了即便在数千个智能体并发时,数据供给也不会掉队。
根据英伟达公布的基准测试,Vera 针对智能体负载的优化效果显著:
单线程性能:在满载情况下,Vera 的单核性能可达传统 x86 CPU 的 1.8 倍。
任务效率:AI 智能体任务综合性能提升约 50%,沙箱环境运行速度提升显著。
并发能力:支持多达 1.6 倍的并发智能体运行,编排速度提升高达 2.2 倍。
编译速度:单颗 Vera 编译 Linux 内核仅需约 20 秒,每核编译效率约为 128 核顶级 x86 服务器的 2 倍。英伟达新的增长曲线
长期以来,英伟达被市场牢牢贴上 "GPU 巨头 " 的标签,但翻开最新的财报与产品路线图,另一个新的信号已经释放——
它正在系统性地摆脱对单一 GPU 销售的依赖,围绕 AI 基础设施的全栈化布局,打开了多条 GPU 之外的新收入曲线。
其中,网络互联业务是增长最迅猛的一条曲线。
2027 财年第一季度,英伟达数据中心网络收入创下 148 亿美元的纪录,同比暴增 199%。
随着 AI 集群从千卡迈向十万卡规模,NVLink、InfiniBand 与 Spectrum-X 已成为构建 "AI 工厂 " 的刚需。
网络业务占数据中心总收入的比重已攀升至约 20%,这标志着英伟达已不仅仅是卖算力的公司,更是卖 " 连接 " 的公司,用物理层面的互联壁垒锁死了系统级竞争力。
紧随其后的是自研 CPU 业务。随着专为智能体 AI 设计的 Vera CPU 于 2026 年 6 月交付 OpenAI、Anthropic 等头部客户,英伟达正式杀入了由英特尔与 AMD 长期统治的服务器 CPU 腹地。
黄仁勋曾表示:"Vera 打开了一个全新的市场,CPU 让智能体等待的每一刻,都是整栋建筑里最昂贵的东西 GPU 处于闲置状态的一刻。"
英伟达从零开始打造了一颗全新的、面向智能体的 CPU。
这是一个新市场,智能体 CPU 要求超快响应,未来会有数十亿个智能体,它们需要为自己而打造的 CPU。
英伟达副总裁兼 CFO 科莱特 · 克雷斯曾透露,预计英伟达 2027 财年 CPU 总收入有望接近 200 亿美元,这使英伟达有机会成为全球领先的 CPU 供应商。
在未来的增长叙事中,Vera CPU 与 Rubin GPU 的放量是最主要的增长动力。


登录后才可以发布评论哦
打开小程序可以发布评论哦