驱动之家 23小时前
1024卡规模当前业界最大!华为发布昇腾950超节点一图看懂
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

快科技 9 月 21 日消息,在 2026 世界人工智能大会上,华为首次对外展出当前业界最大规模超节点产品——昇腾 950 超节点真机。

它是华为面向万亿级大模型训练、高并发中心推理打造的液冷 AI 集群,核心目标是把上千张 NPU 封装成一台逻辑统一的超级计算机,解决大模型训练时多卡通信延迟瓶颈。

整套超节点以昇腾 950DT NPU 芯片作为计算核心,单颗芯片专为大模型训练、解码推理优化,搭载 HiZQ 2.0 HBM 高带宽内存,单卡 HBM 容量 144GB,带宽 4TB/s,支持 FP16、BF16、FP8、MXFP4 等多精度 AI 计算,适配大模型预训练、长上下文推理、MoE 混合专家模型等场景。

架构上采用模块化设计,标准配置为 16 台计算柜 +4 台灵衢互联柜,最大支持 1024 张昇腾 950DT NPU,配套 256 颗鲲鹏 950 CPU,最高提供 1 EFLOPS FP8 算力、2 EFLOPS FP4 算力。

依靠自研灵衢 2.0 全光互联协议,实现跨机柜全光 Mesh 直连,整套集群总互联带宽 1.72PB/s,跨柜往返时延低至 3 微秒,同时支持 256TB 全局内存统一编址,上千张 NPU 可以共享内存空间,不用在多台独立服务器之间来回搬运海量模型数据,大幅降低大模型训练通信损耗。

散热采用全液冷方案,单柜最高支持 100kW 大功率供电,满足高密度算力持续稳定运行;可靠性层面设计了 2+2 光路保护,灵衢链路支持闪断自恢复,就算部分链路故障,业务也不会直接中断,满足 7*24 小时不间断大模型训练需求。

在软件生态上,它依托昇腾 CANN 全栈软件平台,配套开发工具链,支持模型迁移、分布式训练优化。

传统 AI 集群里,多台服务器之间数据交换开销巨大,卡数越多,算力利用率越容易下跌,而昇腾超节点的核心创新,就是打破服务器物理边界,让上千颗 NPU 如同单台设备协同计算,显著提升万亿参数大模型训练效率,适配 Agent 智能体、超长上下文大模型等高算力需求场景

该产品规划 2026 年四季度正式上市,未来还可以多套超节点互联,进一步扩展至更大规模算力集群。

【本文结束】如需转载请务必注明出处:快科技

责任编辑:落木

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

华为 ai 芯片 超级计算机 物理
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论