快科技 7 月 22 日消息,NVIDIA 公布了旗下 Vera CPU 的全新架构细节,包括自研 Olympus 核心的内部设计以及整颗处理器的互连规格。
据介绍,Vera 在单颗计算芯片上集成了 88 个 Olympus 核心,支持 176 个硬件线程,配备 164MB 统一 L3 缓存。
每个 Olympus 核心采用宽前端设计,集成神经分支预测器,每周期最多可取 16 条指令,解码队列容量为 48 条指令,解码器宽度达到 10 路,每周期可处理 10 条融合指令。
核心中段的重命名、分配和提交单元同样为每周期 10 条微操作,还引入了内存重命名、值预测和移动消除等技术来减少依赖性停顿。执行引擎涵盖整数、分支、向量、浮点、加密和专用加载 / 存储资源。
缓存方面,每个核心配备 64KB 四路组相联 L1 指令缓存和 96KB 六路组相联 L1 数据缓存,L2 缓存为 2MB 八路组相联设计。NVIDIA 还加入了多种硬件预取机制,其中包括一个专门针对指针密集型数据结构和图处理负载的图预取器。
Vera 还采用 NVIDIA 空间多线程技术,每个 Olympus 核心提供两个硬件线程。NVIDIA 表示该设计可以在两个线程之间分区核心资源,相比传统同步多线程减少资源争用,一个核心可以优先运行对性能敏感的线程,同时由第二个线程处理系统和管理类任务。
互连方面,Vera 通过第二代 NVIDIA 可扩展一致性总线连接核心、缓存、内存控制器和 I/O。核间带宽最高达 3.4TB/s,SOCAMM2 LPDDR5X 内存带宽为 1.2TB/s,单 CPU 最大支持 1.5TB 内存容量。
Vera 还支持 1.8TB/s 的 NVLink-C2C 接口、PCIe Gen 6 和 CXL 3.1,双路系统提供 176 条 PCIe 通道,采用双节点 NUMA 架构,每个插槽对应一个 NUMA 域。
NVIDIA 声称 Vera 在特定 Agent 负载下性能最高可达 x86 系统的 1.8 倍,该数据基于 NVIDIA 内部 2026 年 7 月的 SPEC CPU 2026 测试,目前尚未经过独立验证。
【本文结束】如需转载请务必注明出处:快科技
责任编辑:黑白


登录后才可以发布评论哦
打开小程序可以发布评论哦