驱动之家 09-11
中科曙光发布词元加速技术体系:IBGDA十万卡级集群完成验证
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

快科技 9 月 11 日消息,中科曙光正式发布 scaleFabric Token 加速技术体系,率先在国内实现 IBGDA 技术(即 InfiniBand GPU 直连异步技术)的规模化应用。

据中科曙光相关产品负责人介绍,scaleFabric 通过构建 " 算存传 " 三级紧耦合的词元加速通道,在网络层面与计算、存储紧密协同,提升词元吞吐效率,实现词元在大模型训练、推理到存储复用全链路的高速流转。

较低时延可减少数据在多级网络中的传输耗时,使 IBGDA 与存储直通带来的路径优化进一步延伸至大规模集群,推动计算、存储与网络协同提升词元生成效率。

在大模型推理时代,混合专家模型(MoE)已成为主流架构,IBGDA 技术的价值进一步凸显。在 MoE 通信中,IBGDA 通过减少 CPU 参与关键通信路径,大幅提升并行通信效率。

此前,IBGDA 的规模化落地主要由国际厂商主导,国产 RDMA 网卡与 GPU 直通的落地案例极为罕见。目前,中科曙光自研 IBGDA 技术已在十万卡级大规模集群中完成验证,实现该领域的关键补位。

随着 IBGDA 进入规模化部署阶段,基于 scaleFabric 的词元加速技术体系有望进一步提升多卡间数据交换效率,为混合专家模型等提供新的国产高速互连选择,也为国产智算基础设施通过系统优化提升整体性能提供支撑。

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

中科曙光 gpu 至大 基础设施 补位
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论