文心芝兰 8小时前
从3%到50%:华为昇腾凭什么仅用四年,就在中国市场掀翻英伟达?
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

一场由 " 不确定性 " 送走、被 " 系统思维 " 接住的攻守互换

2026 年 9 月 17 日的华为全连接大会,被很多科技博主称为 " 中国 AI 芯片的分水岭 "。华为轮值董事长徐直军在与海思首席科学家廖恒的问答中投下了一组让全场安静的数据:在中国市场,华为昇腾 AI 芯片份额已达 50%,而英伟达只剩 8%。就在四年前,这个数字还是完全相反的——英伟达 95%,昇腾 3%。

四年,攻守彻底互换。有人把它形容成 " 奇迹 ",但仔细拆开看,这更像一场逻辑严密的围剿战——送走英伟达的,是美国人自己;接住市场的,靠的却是一整套 " 把单点劣势变成系统优势 " 的打法。

先看这组数字:不是英伟达变差了,是它 " 没法被信任了 "

先说清楚:英伟达的技术没有倒退。但它的份额崩塌速度,比任何竞争对手的攻击都快。

2022 财年,中国市场还贡献英伟达 26.4% 的营收;2024 财年,这个数字跌到 17% 左右;2026 财年,只剩约 9%。更戏剧性的是,黄仁勋本人已在多个场合承认:英伟达在中国 AI 加速器市场的份额 " 已降至零 ",并公开表示英伟达 " 基本认输 "(largelyconceded)给了华为。

徐直军的解释一针见血:" 中华民族是一个忧患意识很强的民族,不能一直受制于人——不能今天被说卖一颗给你,明天又说不卖给你。"

这句话点破了全部逻辑:对中国的云厂商、大模型公司来说,英伟达的芯片再好,也抵不过三个字——不确定性。A100 禁售了,出 H20;H20 又受限了,再出特供版;每一轮出口管制的升级,都意味着已经投产的算力规划可能一夜作废。当 " 买到 " 变成一种赌运气,再忠诚的客户也会开始找备胎。昇腾的 50%,正是从这种 " 不敢赌 " 的情绪里长出来的。

单芯拼不过,就把一百万个芯片变成 " 一台计算机 "

但光有外部推力远远不够。2022 年的昇腾只有 3% 份额,软件生态、开发者习惯、成熟度全面落后——它凭什么接住这么大的市场?

答案是:华为没有在 " 单颗芯片性能 " 这条赛道上硬刚,而是换了打法——算力即系统。

徐直军坦言,受限于可用的先进制程节点,单看芯片性能,华为与英伟达仍有差距。但华为选择了一条更野的路:既然单芯追不上,就让一百万颗芯片像一台计算机一样工作。

这套路线的技术底座是华为首创的 Peerium 计算架构与灵衢总线(UnifiedBus):前者通过嵌套并行、统一内存寻址、对等互联,突破了几十年来盛行的 " 主从架构 " 范式;后者用一套开放的统一协议,把 CPU、NPU、内存、SSD、网卡、交换机全部 " 平等互联 "。

对比最直观的一组数据:英伟达最新的 NVL72 方案,机架内通信带宽高达 1.8TB/s,但一旦跨出机架、改用 InfiniBand 互联,带宽骤降到 0.2TB/s;而华为通过灵衢总线,把机架间通信带宽做到 800GB/s,且全程单一协议、无需来回转换——协议切换的延迟从微秒级压缩到约 150 纳秒。

这意味着什么?英伟达的强项在 " 单机柜内 ",一旦规模扩大到上万颗芯片,通信就会成为瓶颈;而华为的昇腾 950 超节点(Atlas950SuperPoD)支持 1024 颗 NPU 起步、最大扩展到 8192 颗,配合 25.6 万张卡的 SuperCluster 集群正在部署测试——专为 5 万亿参数基础模型训练而生。

用系统集成补单点差距,用数量换性能纵深——这就是 " 算力即系统 " 路线的精髓。单看一颗芯片,你可能差一代;但看整个集群,华为已经站到了全球第一梯队。

生态逆袭:CUDA 不是不可战胜的

技术路线对了,还有一个更难的坎:软件生态。过去两三年,CUDA 就像 AI 开发者的 " 普通话 ",所有人默认在 PyTorch+CUDA 的环境里写代码——这是英伟达最深的护城河。

但廖恒博士透露了一个关键变化:随着模型越来越细粒度、编程复杂度陡增,前沿实验室开始转向 " 大内核风格 " 的新编程语言,CUDA 的绑定正在被新编译器 " 逐渐平衡 " —— "CUDA 不再被前沿实验室视为重要,远不如两年前那么重要了。"

华为的动作更快:CANN 架构 4 个月完成解耦、主流 API 全面兼容;昇腾已对 DeepSeek 系列、Qwen 系列等 70 余个主流大模型实现 "0day 适配 " ——模型发布当天就能在昇腾上开箱即用,背后是 1500 多个预置基础算子。

最标志性的事件是 DeepSeek:2026 年 4 月,DeepSeek 确认其万亿参数旗舰模型 V4 将 100% 运行在昇腾 950PR 上,底层代码从 CUDA 全面转向华为 CANNNext 框架——媒体称之为 " 在一架飞行中的飞机上更换引擎 "。更重磅的是,DeepSeek 据报计划在内蒙古建设部署至少 16 万枚华为 AI 加速器的超大数据中心,并开源面向昇腾算力的基础设施组件。

当中国最头部的大模型公司把命脉押上昇腾,市场的信心一旦立起来,滚雪球就开始了。

甜蜜的烦恼:产能,成了唯一的天花板

份额故事讲到这儿,最戏剧性的一幕来了:华为不是不想赢更多,是造不过来。

徐直军原话:" 由于我们甚至没有足够的产能满足中国国内的需求,我们没有计划全面拓展国际市场。" 确实有几个国家对昇腾有强烈需求,但 " 正在进行一些测试,并向这些国家提供一些供应,数量相当有限 " ——比如马来西亚,正在考虑将昇腾 910C 作为其主权 AI 计划的核心。

产能有多紧?伯恩斯坦估计,华为 2026 年目标出货约 160 万颗昇腾芯片,接近 2025 年约 60 万颗的近三倍,但依然供不应求——有消息称字节跳动已向华为下了 56 亿美元的大单,几乎吃掉华为 75 万颗 950PR 年产目标的一半。

徐直军把时间表也交了底:全球算力供需平衡大约在 2029 年左右实现,中国市场可能更慢。眼下光模块、存储都因为 AI 需求暴涨而溢价销售——瓶颈不只在芯片制造,而在整条产业链。

冷静账本:领先不等于赢家通吃

必须泼一点冷水:这份 50% 的领先,是 " 主场优势 " 与 " 供应安全 " 共同作用的结果,不等于华为已经全面碾压。

- 制程差距仍在:华为受限于可用先进制程,单芯性能与英伟达最新旗舰仍有代差,这是徐直军亲口承认的;

- 生态差距仍在:全球开发者生态、学术训练习惯仍以 CUDA 为主,昇腾的护城河更多建在国内市场;

- 份额口径不一:50% 对 8% 是华为收集数据与伯恩斯坦预测的叠加,机构间口径并不完全统一(如 TrendForce 预测 2026 年中国高端 AI 芯片国产渗透率接近 90%,IDC 统计国产厂商在 AI 加速器服务器市场约 41%)。

但有一个判断是确定的:AI 芯片的全球版图,已经从 " 一超独大 " 走向 " 多极并存 "。中国市场的这场攻守互换证明了一件事——在供应安全面前,性能优势的优先级正在被重新排序。

四年,3% 到 50%。有人把这归功于出口管制,有人归功于华为的技术路线,但最准确的说法或许是:这是一场被 " 不确定性 " 加速、被 " 系统思维 " 接住的替换。英伟达输掉的不是技术战,是信任战;华为赢下的不是单点性能,是整条供应与生态链。

徐直军最后那句话,值得品很久:" 即使我们的芯片可能不那么先进,至少供应是有保障的,这样你就不必日复一日地担心芯片供应。"

份额只是过去的结果。下一场战争的胜负手,是产能爬坡的速度,和生态渗透的深度——这两道题,华为都还在赶路。

下图把四年攻守互换一眼看清:

2022 年为出口管制前格局(英伟达 95%/ 昇腾 3%);2026 年为华为全连接大会公布数据与伯恩斯坦预测(昇腾 50%/ 英伟达 8%),AI 芯片中国市场占比,各机构口径存在差异。

关键结论:英伟达从 95% 跌至 8%,昇腾从 3% 升至 50% ——四年间双方位置彻底互换;但需注意这是华为口径与机构预测的叠加,单芯性能差距与制程受限仍是现实短板。

事件发生于 2026-10-07 北京市

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论