最近一张关于华为 AI 芯片的预测图很扎眼。
美国研究机构 Epoch AI 测算,如果未来华为主要依靠长鑫存储、武汉新芯等国内供应链提供 HBM,到 2028 年能够生产出来的 AI 算力折算成 H100 等效,大约只有英伟达同期的 1%。
这个数字第一眼看过去很吓人。
英伟达接近 1 亿张 H100 等效算力,华为大约 100 万张,差距接近 100 倍。
美国外交关系协会高级研究员 Chris McGuire 过去也一直主张,限制先进芯片和半导体设备出口,可以长期维持美国在 AI 算力上的领先。
但我把 Epoch AI 原报告完整看了一遍后,发现 "1%" 这个数字不能直接理解成 "2028 年的华为 AI 只有英伟达 1%"。
因为这张图实际上回答的是一个非常具体的问题:
假如华为未来只能靠国产 HBM,最多能生产多少 AI 算力?
这和华为最终到底能够部署多少 AI 算力,不完全是一回事。
报告自己就给出了另一个数字。2026 年,它预计华为会生产约 150 万颗昇腾芯片,折算后大约 88 万张 H100 等效算力,而英伟达约 2300 万张,华为占比接近 4%。这里面已经包括约 75 万颗昇腾 950PR。
问题来了:950PR 恰恰没有走传统 HBM 路线。
Epoch AI 判断,这颗芯片大概率使用一种更接近 LPDDR 的非 HBM 内存方案,128GB 容量、1.6TB/s 带宽。
带宽当然比顶级 HBM 低,但华为把它主要放在 Prefill,也就是大模型推理中计算密度更高、对内存带宽相对没那么敏感的阶段。
美国现在真正想卡的,已经不只是 " 你能不能造 GPU",而是 GPU 旁边那几摞不起眼的内存。
AI 芯片越来越快之后,大量时间其实花在把模型参数和数据送进计算单元。HBM 之所以变得重要,就是因为普通 DDR、LPDDR 的数据吞吐已经越来越跟不上 GPU。
所以今天 AI 芯片竞争里出现了一个很少有人注意的变化:
Epoch AI 认为,这恰恰是华为未来几年最大的数量瓶颈。
按照它采用的模型,到 2028 年中国国产 HBM 供应虽然会明显扩大,但英伟达能够获得的全球 HBM 资源依旧更多,而且单颗 GPU 使用每 GB 内存能够换来的计算能力也在继续提高。 ( Epoch AI )
这一部分,我觉得没必要回避。
华为现在和英伟达之间确实存在很大的单芯片性能、HBM 供应以及软件生态差距,把 " 国产替代 " 理解成两三年就能在总算力上完全追平,并不现实。
但这份报告另一半反而更值得看。
因为华为没有按照英伟达的路线原封不动地追。
HBM 不够,就把不同推理阶段拆开,950PR 用更容易获得的非 HBM 内存负责 Prefill,把高带宽内存留给更需要带宽的 Decode;单颗芯片不够强,就把更多芯片通过高速互联组织到一起。
CloudMatrix 384 就是这条路线最典型的产物。
SemiAnalysis 此前拆解这套系统时给出的判断很有意思:384 颗昇腾 910C 组织起来后,在部分系统指标上已经可以和英伟达 GB200 NVL72 竞争,内存容量和聚合带宽甚至更高,但代价也非常明显——需要更多芯片、更复杂的光互联,而且整套系统功耗大约是 GB200 NVL72 的 4 倍。
这其实才是中国 AI 算力现在最真实的状态。
不是 " 已经追平英伟达 ",也不是 " 只剩 1% 所以毫无机会 "。
而是在单芯片、制程和 HBM 暂时吃亏的情况下,用更多芯片、更大的系统、更强的互联和软件调度,把原本应该在一颗 GPU 上解决的问题,搬到整个机柜甚至整个集群里解决。
这种方法当然有成本。
更多芯片意味着更高功耗,更大的集群意味着更复杂的网络,软件稍微调度不好,理论算力就会浪费掉。
英伟达真正难追的地方也从来不只是 GPU,还有 NVLink、CUDA 以及多年积累下来的整套计算生态。
所以那张 "1%" 图并不是假的。
真正的问题是,很多人把它的使用条件给删掉了。
Epoch AI 自己也承认,H100 等效只是纸面计算指标,并没有完整计入内存、互联规模、工作负载、软件效率等因素;报告同时明确讨论了 950PR 使用非 HBM 内存作为绕开 HBM 约束的一种可能路径。
换句话说,美国真正想证明的是:只要 HBM 供应长期受限,华为就很难按照英伟达现有的硬件路线扩大 AI 芯片产量。
而华为现在试图回答的是另一个问题:
既然这条路被堵住了,能不能干脆换一种系统架构?
最终谁对,现在还远没有答案。
但我觉得这比争论 "1% 到底丢不丢人 " 重要得多。
AI 算力竞争已经从一颗芯片的参数表,进入到制程、HBM、互联、软件、数据中心和电力一起较量的阶段。
华为短期内很难在单卡上追平英伟达,这一点并不需要回避;可如果只拿一张 " 国产 HBM 约束模型 " 就判断 2028 年的中国 AI 算力上限,同样过早。
真正决定结果的,可能不是谁把同一条路跑得更快。
而是谁能在原来的路被堵住之后,先找到另一条还能规模化跑起来的路。


