第一财经 15小时前
腾讯四季度部署NPO超节点,光互连迎来商业化窗口
index.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

大模型持续向万亿参数演进,AI 基础设施竞争正从单颗 GPU 性能转向超大规模集群互连能力。

近日,在世界人工智能大会(WAIC)期间,腾讯云首次披露了国产算力和光互连的新部署计划:公司将于明年及后年大规模部署国产化算力,并预计 2026 年第四季度部署 NPO(近封装光学)超级节点,同时呼吁推动国内外 NPO 行业标准统一。

这一技术路线也正在产业链和资本市场快速形成共识。第一财经记者注意到,今年 WAIC 上首次设立了 AI 光算力全产业链专区,中际旭创、源杰科技、曦智科技等企业集中展示了从磷化铟、硅光、光芯片到光交换超节点的完整产业链。

与此同时,资本市场也持续加码光互连赛道。今年以来,中际旭创通过港交所上市聆讯,Marvell 以 32.5 亿美元收购光子互连初创公司 Celestial AI,曦智科技登陆港交所,光本位科技、光子芯力、奇算光启等企业也相继完成新一轮融资,光互连正从技术探索逐步进入产业兑现阶段。

产业链集体卡位光互连

今年 WAIC 上,华为、中兴通讯、燧原科技等厂商展出的超节点产品,几乎都离不开光互连技术的支撑。超节点规模越大,对芯片间通信的要求越高,光互连的必要性也越突出。

上海市经济和信息化委员会副主任俞文杰近日在 WAIC" 光计算 + 光互连 双轮驱动的 AI 基础设施新范式论坛 " 上表示,当前,人工智能加速向各行业渗透,算力需求呈指数级攀升。传统电子算力在制程、功耗和带宽方面逐步逼近物理极限,以光计算、光互连为代表的光子技术,凭借高通量、高带宽、低延迟、低功耗的独特优势,正从未来选择变为现实支撑。

中国移动副总经理李慧镝也认为,面向万卡乃至十万卡级集群,单纯依靠传统路径已经难以满足未来发展需求。光与电不是简单替代关系,而是在不同层级、不同场景中优势互补,共同推动 AI 基础设施向更高性能、更高能效、更大规模演进。

在曦智科技创始人沈亦晨看来,光互连的产业方向 " 已经没有争议,赛道和跑道已经很明确了 ",现在是 " 谁跑得最快、谁能更快把产品做得更好 " 的问题。

光互连产业链上正分化出不同的玩家。根据中国移动发布的《面向大规模智算集群场景光互连技术白皮书(2025 年)》,国际厂商以博通、英伟达、英特尔、Lightmatter 等为代表,已经形成了从技术验证到商用量产的闭环。国内处于从研究向应用转化的起步阶段,头部企业包括曦智科技、奇点光子、图灵量子等。

以曦智科技为例,招股书显示,公司 2023 年至 2025 年营收分别为 0.38 亿元、0.60 亿元、1.06 亿元。其中,光互连解决方案是曦智科技主要的收入来源,2025 年 Scale-up 光互连产品收入达 7558 万元,占总营收的 79.2%,但公司仍处于高投入阶段,尚未实现盈利。

TrendForce 集邦咨询预计,CPO/ NPO 市场规模将大幅成长,自 2025 年约 1 亿美元,跃升至 2030 年的 390 亿美元以上。

申万宏源在研报中称,光互连行业虽处早期,但国内 GPU 厂商无成熟对外方案,海外高端互连仅自用不对外,形成 " 需求旺盛、供给真空 " 的窗口期。" 光互连业务预计跟随国内超节点放量而快速起量。" 申万宏源称。

NPO 先行:中国产业链的务实选择

NPO 被认为是 CPO(共封装光学)技术实现攻关之前,优于传统可插拔光模块、线性驱动可插拔光模块(LPO)的新一代光互连技术。

在技术路径上,NPO 将光引擎部署在芯片封装附近,CPO 则将光引擎与主芯片集成于同一封装基板,以缩短高速电通道,提升信号完整性、能效和 I/O 带宽密度。中国信通院的报告将演进路径概括为三步:NPO 过渡商用、CPO 成为主流、OIO(光输入输出)成为终极形态。

在此次论坛上,多位嘉宾的共识是:NPO 是当下更适合中国产业链的务实选择。

沈亦晨判断,NPO 是目前 " 最容易第一步达到、对整个产业链生态扰动最小 " 的技术方案。核心原因在于:NPO 去掉 DSP(数字信号处理器)后,虽然对光引擎性能要求大幅提高,但缩短的铜导线距离带来的信号降噪,可以部分弥补去掉 DSP 的损失。这使得 NPO 方案在功耗和成本上都有优势。

腾讯云副总裁、腾讯网络总经理王亚晨则提到了 NPO 的落地时间。

" 腾讯认为 NPO 是到达 CPO 过程中的一个中间技术路线。" 王亚晨表示,考虑到先进封装的技术能力,两三年前腾讯曾判断 NPO 不会那么快落地,并于两年前计划在 2026 年第四季度进行 NPO 部署。

王亚晨预计,明年 NPO 会有更快速的发展。他的判断与一些业界人士的判断基本一致。壁仞科技 AI 框架架构副总裁丁云帆近日也告诉记者,今年多家厂商都在做 NPO 光互连技术攻关,业界对 NPO 方案已有共识,技术具备可行性,只是研发仍需时间,预计 NPO 光互连方案明年将逐步落地,2028 年基于 NPO 光互连的超节点落地将实现规模化。

从 NPO 方案看,多家互联网厂商则计划在高密计算机柜内通过 NPO 直接出光,然后多个机柜通过光连接到交换机柜上,实现大规模的一层全交换超节点。以字节为例,业界人士向记者分析,其大禹架构 2.0 采用 Cable Tray 方案,单柜 64 卡(单卡双芯),支持双柜并柜扩展,但也只能做两柜,难以继续扩展。到了大禹架构 3.0,便采用了一层 NPO 光交换方案,以实现 512 卡超节点规模。腾讯 ETH-X Ultra 光互连超节点、阿里 UPN512 也采用一层 NPO 光交换的方式实现 512 卡超节点规模。

规模化落地仍面临挑战

如今,整条产业链正在加速集结,但规模化落地仍有挑战。

上述报告显示,光互连技术产品化受集成光学器件的市场接受度、标准和制造能力的限制,仍面临多个方面的挑战,尤其是在标准、封装工艺、器件性能、散热、仿真测试及良率等维度。

百度网络架构组负责人李虎在论坛上表示,柜内铜缆在成本和稳定性上仍有优势,但随着 Scale-up 规模持续扩大,柜间互联必然向全光互连演进。

沐曦股份 CTO 彭莉从芯片设计角度强调,光互连不是简单的物理层替换,而是 " 软硬件系统级的协同设计 "。她指出,GPU 的 SerDes 接口应该为光传输重新设计," 端到端一体化方案才会更容易落地 "。

有业界人士向记者表示,各家的 NPO 方案说明互联网大厂在技术演进上仍在采用电互连技术推动产业落地,同时为了布局下一代技术进行先进技术攻关。但一些互联网大厂 NPO 方案仍存在待解决的问题,包括机柜需要高度定制,需要上游芯片厂商为其单独做方案,有周期长和成本偏高的特点,影响产业化落地节奏,业界的下一步改进方向包括推动机柜标准化。

要促进 NPO 生态发展,王亚晨则提到,国内外不同云厂商的 NPO 产品都有差异,希望能把标准统一下来。除光互连超节点计划外,腾讯还将于明年及后年大规模部署国产化算力,降低推理的整体成本。

谈及国产算力短板,沈亦晨认为,当前最亟需补强的,是在庞大算力产业链中构建真正开放的产业生态,使计算、存储、交换、软件、应用等各环节的优秀企业最大化发挥各自优势,共同驱动中国算力基础设施的升级。

( 本文来自第一财经 )

评论
大家都在看