
7 月 22-23 日,旧金山 "Advancing AI 2026" 大会现场火药味十足。AMD 发布了基于 CDNA 5 架构的 MI455X GPU,以及由其驱动的首个全栈机架级方案 Helios。这不仅是新产品的亮相,更是一次对英伟达 Oberon 及未来 Kyber 方案的直接宣战。
Helios 机架采用全液冷设计,塞进了 72 块 MI455X GPU 和 18 颗第六代 EPYC Venice CPU。单机架 FP4 算力高达 2.9 Exaflops,FP8 算力也有 1.4 Exaflops。数据背后,是 AMD 清晰的战术意图:在大规模推理场景争夺主动权。
面对英伟达下一代 Rubin GPU,AMD 选择了一条差异化路径。MI455X 配备 432GB HBM4 内存,比 Rubin 多出 50%。虽然 19.6TB/s 的带宽略逊于对手的 22TB/s,但更大的容量配合分片加载能力,能有效降低跨节点通信的延迟与成本。在 FP8 算力上,MI455X 以 20 PFLOPS 小幅领先 Rubin 的 17.5 PFLOPS。AMD 显然想在对总拥有成本敏感的推理市场,率先撕开一道性价比缺口。
路线图的另一端同样攻势凌厉。MI500 系列确认为 MI450 的继任者,而与 OpenAI 合作的 MI400 系列则锁定 2026 年窗口期。数据中心 CPU 方面,Venice 与 Verano 按计划迭代,试图复现超算领域 CPU 与 GPU 紧耦合的成功经验。
然而,硬件参数的漂亮并不等于市场份额的唾手可得。
大会前夕,SemiAnalysis 披露的一则消息给 AMD 泼了盆冷水。Meta 向 AMD 定制了一款 " 缩水版 "MI450X 芯片:计算单元减半,HBM 内存从 12 层砍到 8 层,容量缩水近三分之二。Meta 声称这是为了优化推荐系统负载,但研究机构直言这一决策堪称 " 灾难 "。因为 Meta 核心大模型团队对此毫无兴趣,反而更倾向采购英伟达的 Vera Rubin。
这折射出 AMD 面临的深层尴尬:当它试图用旗舰芯片冲击英伟达在生成式 AI 训练领域的护城河时,部分大客户仍将其视为特定场景下的 " 备胎 " 或成本优化选项。这种定位偏差,可能将 AMD 限制在利润较薄的细分市场。
软件生态则是另一座需要长期攀登的高山。
尽管 AMD 已发布 ROCm 7.2 并强调开放生态,但要让开发者从成熟的 CUDA 阵营迁移,绝非一日之功。易用性、算子覆盖度,每一个短板都可能成为阻碍。硬件参数的领先,必须转化为实际部署量的增长,才能逐步填平与英伟达之间的生态鸿沟。
从单卡规格到系统设计,AMD 的技术储备已足够让市场重新评估其竞争力。但如何平衡大客户的差异化需求,同时让软件生态跟上硬件迭代的速度,才是决定这些技术指标能否真正转化为对英伟达实质威胁的关键。
参数赢了只是开始,生态突围才是终局。
【星途科讯 图文丨王宇洲 首发于 ZAKER 科技,转载请注明出处】


