21世纪经济报道 17小时前
WAIC2026芯片“共识”:超节点才是未来
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

每年的世界人工智能大会(WAIC)都是观察科技趋势的绝佳窗口。今年的 WAIC,趋势是什么?

" 超节点 " 一定是答案之一。在世博展馆算力展区内,参观者在一组组体型庞大的黑色机柜前排起了长队,他们要打卡的并非某个消费电子产品,而是 " 超节点 " 这一最受关注的算力基础设施。

华为首次公开展出昇腾 950 超节点(Atlas 950 SuperPoD)真机;中兴通讯发布 OEX 超节点,支持多元 GPU 生态兼容;壁仞科技推出下一代 NPO 光互连、分布式解耦架构超节点方案,支持单个超节点 1024 卡 Scale-up 扩展;沐曦股份首发 " 曦景 "S 系列超节点产品,构建全栈国产算力产品矩阵;燧原科技发布多款高性能超节点方案,满足万卡级以上大规模集群组网需求……国产 GPU 主流厂商几乎全部到场,同台竞技。

多家机构将 2026 年称为 " 国产超节点方案量产元年 "。据华泰证券测算,2028 年国产超节点市场空间有望达到 3414 亿元,2026 年至 2028 年复合年均增长率高达 194%。

超节点方案的集中涌现,标志着国内芯片厂商正跳出单一制程追赶的传统路径,以架构创新为核心突破口,放大集群内系统级互联的作用以弥补单卡差距。这正是国产算力的破局之道。

图片来源:视觉中国

国产方案 " 百家争鸣 "

当大模型参数从千亿迈向数万亿,Agent 等应用场景要求百万级上下文长度,推理和训练都需要成千上万张 GPU 协同工作……仅凭单张 GPU 的算力性能,已难以独立承载上述复杂任务。

在此背景下,如何实现海量 GPU 高效协同运行?超节点架构的出现,就是为了破解这个核心难题。

目前,主流的电互连超节点方案通常有两种架构:‌铜缆托盘(Cable Tray)互连‌和正交互连。在多家 GPU 厂商的展台上,21 世纪经济报道记者都看到了相关产品。

以燧原科技展示的云燧 ESL64-C 超节点(Cable Tray 方案)为例,其单个整机柜支持 16 个计算节点、12 个交换节点,可通过传统 Scale-out 扩展方式构建更大规模、更高效的算力集群。" 该技术方案较为成熟,商用落地已得到充分验证,组网拓扑高度灵活,扩容拆分自由,而且机房改造门槛低,存量设备利旧率高,能兼容现有标准整机柜服务器。" 燧原科技现场技术人员对记者表示。

在现有超节点技术上,各家厂商还在进行新的探索。

本次 WAIC 期间,中兴通讯联合壁仞科技、沐曦股份、燧原科技、天数智芯等国产 AI 芯片公司,发布了 OEX 超节点。OEX 架构超节点的特点在于,实现计算节点托盘和交换节点托盘的垂直交叉互连,摒弃了此前依靠成千上万根高速线缆进行互连的传统设计。

云燧 ESL64-O 超节点就是燧原科技与中兴通讯合作的正交架构方案,单个整机柜支持 16 个计算节点、4 个交换节点。现场技术人员告诉记者:" 该方案通过正交连接器与单级交换拓扑,实现计算节点与交换节点之间的垂直交叉互连,显著降低通信损耗,保障信号完整性。而且‘无背板零线缆’设计能有效降低互联成本,减少故障点。"

沐曦股份推出的曦景 S600 方案则通过正交连接器与两级交换拓扑,实现 GPU 之间低时延、高带宽通信,有效提升分布式训练效率,可实现单机柜 64 卡高速互连,并可横向扩展扩容至万卡级别,为智算中心未来持续扩容预留充足空间。

天数智芯的超节点方案面向大模型训练与高并发推理场景,以国产通用 GPU 为核心,实现 144 芯电互连高速全互联。21 世纪经济报道记者了解到,天数超节点已获得多家潜在客户关注,并进入方案交流与合作推进阶段。

另外值得关注的是,去年的 WAIC 上,虽然超节点方案也有发布,但到了今年,这几乎成为整个国产算力行业的集体共识。为何超节点方案在此时点受到极大关注?

" 根本上是为了应对万亿参数模型、Agent 应用等新的业务场景,超大规模的超节点成为算力刚需。" 壁仞科技 AI 框架架构副总裁丁云帆告诉 21 世纪经济报道记者。

" 一个关键的问题是如何让产业链上的不同环节实现协议统一。" 沐曦股份联合创始人、CTO 彭莉接受 21 世纪经济报道记者采访时表示," 去年以来,交换机、GPU 厂商发现相关接口协议慢慢变得通用、统一,那么做超节点就是顺理成章的事情。"

超节点的未来:NPO 和 CPO

更往前一步,超节点将往哪个方向发展?

以当前主流的电互连超节点方案为例,其正面临规模扩展的物理极限。随着 GPU 算力持续增长,互连带宽需求将超过 1TB/s,端口速率将达到 224Gbps,而铜缆电信号在 3 米内就会严重衰减。现有电互连超节点架构一般最多支持 128 张 GPU,无论是 Cable Tray 架构的运维难度,还是正交背板架构的扩展瓶颈,都难以满足下一代数万亿参数大模型对数百卡至千卡级超节点的需求。

光互连,便成为突破这一瓶颈的必然选择。光信号传输距离可达数百米,衰减极小,天然适合大规模 GPU 互连。这也是行业主流厂商都在加速布局光互连超节点的原因。

当前光互连有四种主要技术路线:传统可插拔(FRO)、线性直驱(LPO)、近封装光学(NPO)和共封装光学(CPO)。

丁云帆告诉 21 世纪经济报道记者,当前产业界在光互连技术路线上,讨论焦点已不再集中在较为成熟的 FRO 和 LPO 方案。行业的关注点和资源已全面转向代表未来的 NPO 和 CPO 方案。" 尤其是 NPO,正成为产业链协同攻关的核心。"

据悉,NPO 将光引擎直接与 GPU 模组融合,去掉了高功耗的 DSP 芯片,同时传输距离可达数百米,兼具低时延和高带宽密度,是在性能、功耗、成本和工程可落地性之间取得最佳平衡的方案。

目前来看,国内 GPU 主要玩家在光互连方案上各有千秋。

壁仞科技首次提出 "NPO 光互连、分布式解耦架构 " —— GPU 节点和交换机节点物理分离部署、光纤灵活互连,GPU 节点也可以采用标准机形态,彻底告别了传统定制高密整机柜方案的 " 大铁盒子 " 形态。这意味着超节点的规模不再受限于单个机柜的物理空间,可以像搭乐高一样灵活扩展到 1024 卡,运维和散热也变得更加简单。

尤其是壁仞首创的 Chiplet(芯粒)架构大算力芯片,新一代 BR2xx 系列 GPU 沿用这一技术路线,把多个计算芯粒像拼积木一样组合成一颗高算力芯片,突破单芯片制造的物理限制。这成为壁仞超节点方案的算力基石。壁仞自研的 BLink2.0 超节点互连协议,支持内存语义、统一编址、在网计算、拥塞控制、链路修复等多项核心能力,成为连接 1024 卡构建 " 超级 GPU" 的神经系统。

燧原科技也展示了自研的 NPO 光互连原型系统方案,突破传统铜互连距离限制,支持 512 卡以上超节点部署及超大规模集群弹性扩展。

计算光互连系统不仅仅是 GPU 之间的连接,还可以更进一步用光交换(OCS)代替电交换。AI 硅光芯片设计厂商曦智科技在 WAIC 上展示了光跃 LightSphere X 分布式 OCS 全光超节点,已实现 2000 卡规模化落地,打造了国内首个国产、商业化的光互连光交换千卡算力集群。该超节点实现了大模型训练性能 30% 以上提升,同步提升推理响应效率、集群算力利用率和服务吞吐能力。

尽管市场对光互连的未来多有期待,但彭莉也表示,引入 NPO 和 CPO 这些热门的光互连方案也带来新挑战:需要将光引擎(完成光电信号转换的核心部件)靠近交换芯片(负责处理和交换数据)封装,这可能引发稳定性问题。因此她认为,目前在超节点互连方案的选择上,凡是电互连能覆盖的场景还是要用电互连,其在稳定性和成本控制方面仍具显著优势。

丁云帆则预计," 到 2028 年,NPO 光互连超节点可能实现规模化部署。"

无论国产算力厂商在超节点这条路上选择怎样的技术路线,当单颗芯片的性能提升遇到物理瓶颈时,系统级的组织效率正在成为新的算力竞争高地。这正是 WAIC 2026 芯片厂商们最大的 " 共识 "。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

中兴通讯 华泰证券 gpu 芯片 破局
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论