驱动之家 昨天
彻底解放CPU!英伟达正式发布SCADA技术:让显卡直连硬盘 读写性能暴涨5倍
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

快科技 8 月 5 日消息,英伟达在 FMS 2026 峰会上宣布,将旗下的 GPU 存储加速 API cuFile 全面开源,同时公布 SCADA 全新存储架构,彻底打破传统 CPU 主导 IO 的传输瓶颈,实测场景下 GPU 存储 IOPS 最高实现 5 倍提升。

长期以来,GPU 读取数据必须通过 CPU 进行调度,这种宿主模式在处理 AI 推理产生的大量 512 字节微小请求时,会造成严重的微秒级延迟。

虽然之前的 GPUDirect Storage(GDS)实现了数据链路的 CPU 绕过,但指令控制仍需 CPU 参与,使得系统在小粒度读写任务中提前触发性能瓶颈、IO 资源率先耗尽。

此次推出的 SCADA 技术彻底解决了这一难题,SCADA 允许 GPU 直接发起存储 I/O 请求,管理 NVMe 硬盘的队列深度,实测数据显示,在处理数据分析任务时,SCADA 的速度是 CPU 触发模式的 5.3 倍,而硬件成本最高可降低 21.7 倍。

在美光展示的参考设计中,使用 3 颗 H100 显卡成功驱动了 44 块 PCIe Gen6 SSD,实现了惊人的 2.3 亿次随机读 IOPS。这意味着单台服务器的存储吞吐达到了 118GB/s,且负责调度的单颗 CPU 在整个过程中几乎处于空闲状态。

同时针对 AI 推理中 KV 缓存频繁产生的小数据读写,英伟达正式推出 Storage-Next 产业联盟计划,重点优化 512 字节扇区的读写表现,以解决传统硬盘在 4KB 扇区下造成的 8 倍读取放大问题。

该构想最早在 2025 年 GTC 大会提出,目前联盟成员已超 40 家闪存与存储厂商,包含 DDN、铠侠、美光,还有存储控制器企业、散热厂商以及标准化组织,各方将共同制定一套新标准:当 GPU 取代 CPU 成为存储访问主体时,固态硬盘应当如何适配运行。

硬件层面上,为承载 cuFile 开源生态与 SCADA 全新存储架构的落地,英伟达打造了新一代基于 Vera BlueField-4 存储处理器的 STX 架构系统,并计划在 2026 年下半年正式推出商用整机。

虽然目前英特尔也已加入开源组织并参与代码维护,标志着传统 CPU 主导 IO 调度的格局被颠覆,cuFile 与 SCADA 也从英伟达私有技术,升级为全行业通用开源标准,有效改善了跨平台兼容性。

但该技术的规模化普及仍受两大核心条件制约,一是 STX+SCADA 新架构的跨硬件、跨平台适配优化进度。二是美光、三星等厂商能否针对 512 字节小包场景完成主控与固件的底层重写。

这两点最终决定了这套新一代 AI 存储架构的商用普及节奏。

【本文结束】如需转载请务必注明出处:快科技

责任编辑:青山

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

英伟达 ai 开源 gpu 数据分析
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论