李明白看科技 1小时前
AMD轻取NVIDIA!CPU实力超预期
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

NVIDIA 进军 Arm 架构

其实,NVIDIA 早就开始做 CPU 处理器了,但因为拿不到 x86 架构的授权,只能走 Arm 架构这条路,所以性能上一直不太突出,生态也受限,应用场景也比较窄。

比如他们家的 Tegra 处理器,早在 2008 年就出来了,最开始是用在智能手机和平板上的(像小米 3 用的就是 Tegra 4,不过那体验嘛……只能说一言难尽)。后来慢慢转向汽车、游戏机和嵌入式设备这些领域。

现在 Arm 架构也开始发力了,一方面想进军 PC 领域,比如高通的骁龙 X 系列,微软和很多 OEM 厂商都挺支持的,势头挺猛的。

另一方面,Arm 在云服务器这块也表现得很抢眼。AWS、Google、微软、Ampere、Marvell、阿里、华为海思 / 鲲鹏、飞腾等等,都在大力投入 Arm 架构的服务器芯片。甚至 Arm 自己都亲自下场搞了,现在在某些领域的出货量,已经慢慢追上甚至超过 x86 了。

NVIDIA 全面布局 AI 市场

NVIDIA 也早就看准了这个大趋势,开始全面发力了:

他们为了抢占 AI PC 市场,推出了 RTX Spark,号称要重新定义 PC 的玩法。而在 AI 数据中心这块,他们也接连推出了 Grace 和 Vera,尤其是 Vera,第一次直接和 x86 架构打起了正面仗。

NVIDIA 的 Vera 处理器,号称是为 " 智能体 AI" 时代量身打造的,性能非常强悍,专门处理某个 Agent 任务的话,比传统的 x86 CPU 快了整整 1.8 倍。

这颗芯片用的是自研的 Armv9.2-A 架构,最多能有 88 个核心,176 个线程(支持空间多线程技术),还有 164MB 的三级缓存(之前标注过 162MB)。它还支持 NVLink-C2C、PCIe 6.0 和 CXL 3.1 这些先进的接口技术。

核心、缓存、内存控制器和 I/O 之间通过第二代一致性总线连接,核间带宽最高能达到 3.4TB/s,内存带宽也有 1.2TB/s,单路最大支持 1.5TB 的内存。

像 Anthropic、OpenAI、SpaceX AI、字节跳动、甲骨文这些大公司都已经计划部署 NVIDIA 的 Vera 了,开局看起来挺不错的。

Zen6 架构性能优势

之前,AMD 就拿他们即将推出的 Zen6 架构旗舰产品—— 256 核 512 线程的 Venice EPYC,跟 NVIDIA 的 Vera 做了一个对比。

AMD 说,在机柜部署、整机功耗 100 千瓦的情况下,这个 256 核的 Venice 性能,竟然达到了 88 核 Vera 的 3.3 倍!这差距有点大啊。

就算是稍微早一点的 Zen5 架构、192 核 384 线程的 Turin EPYC 9965,跟 Vera 比起来也有 1.39 倍的性能优势,也就是领先将近 40%。

另外,AMD 还特别提到,因为核心密度更高,Venice 每个机柜里能放超过 3.6 万个核心,而 NVIDIA 的 Vera 只能放 2.25 万个,差距很明显。

Zen6 性能超越预期

现在,AMD 的 Zen6 EPYC 9006 系列正式登场了,他们这次又跟 NVIDIA 的 Vera 做了一次性能对比,结果让 AMD 自己都 " 非常惊喜 "(也就是特别开心),比他们之前预想的还要好很多。

这次对比,AMD 直接用了 NVIDIA 白皮书里给出的配置方案:256 核、600 瓦功耗的 AMD Venice EPYC,对上 88 核、450 瓦功耗的 NVIDIA Vera。两者一起跑 SPEC 基准测试,AMD 还强调整个对比过程是公平的,条件完全一致。

AMD 说,Venice 在单核性能上达到了 Vera 的 1.2 倍,而整体吞吐量更是达到了 Vera 的 2.2 倍。

AMD 计算与企业解决方案部门的副总裁 Ravi Kuppuswamy 表示:"NVIDIA 愿意公开 Vera 的性能数据,对我们来说是个好事。其实我们之前的预估还是太保守了,原本以为能领先 10%,结果实测下来达到了 20%。而且我们还没完成全部优化工作呢。"

性能对比分析

虽然 AMD 一再强调他们的对比是公平的,数据也都是基于真实测试的,但大家心里都清楚,这种对比通常都会在测试环境和测试项目上尽可能地偏向自己。比如说,像 SPEC 这样的基准测试,对正式的有效结果有非常严格的标准,而这次两组数据都没有提交给 SPEC 认证,所以都不是官方成绩,AMD 在图表里也特别标注了 " 估算值 "。

单核性能是通过多核性能除以核心数得出来的,两家分别是 6.3 和 5.3,领先幅度大概 18%,这个数字确实跟图表里的结果是一致的。

不过,AMD 这边的核心数量多很多,功耗上限也更高,所以在吞吐量上大幅领先也是情理之中的事。更何况,吞吐量本来就不算是 NVIDIA Vera 的强项,它也不是直接跟 Venice 的 256 核心正面硬刚的。

目前双方的较量主要集中在整数运算性能上,但浮点向量运算同样非常重要,这方面 AMD 一直都有比较大的优势,NVIDIA 一时半会儿也很难撼动。

当然了,现在这一切都还只是 " 纸上谈兵 ",真正的胜负还得看实际部署后的性能表现、客户采纳情况等等。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

nvidia amd ai arm架构 芯片
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论