快科技 9 月 17 日消息,在 2026 年 AI Infra Summit 上,英伟达正式发布 DSX MaxLPS 全厂级功耗优化系统。该系统可在不增加电力基础设施的前提下,将每兆瓦 Token 产出最高提升至 1.4 倍,即最高提升 40%。
英伟达超大规模与高性能计算业务副总裁 Ian Buck 在演讲中表示,衡量 AI 基础设施的指标正在从峰值性能转向每兆瓦可验证的智能体 Token 产出,AI 工厂需要从芯片到电网协同设计。

DSX MaxLPS 的核心能力是动态重新分配 GPU 与机架之间的功率。该系统将同样的电力预算分散到更多节点上运行,而非让少数节点满功率运转,从而在总功耗不变的情况下产出更多 Token。
实际测试数据来自 AI 云服务商 Lambda。Lambda 在 19 个节点的 HGX B200 集群上运行 DSX MaxLPS,让所有 19 个节点以 85% 功率运行,替代原本 16 个节点满载的方案,Token 吞吐量从约每秒 400 万提升至约 500 万,增幅达 24%。
与此同时,每瓦性能也同步提升了 23%。对于这一能效表现,Lambda 云服务总裁 Dave Ward 表示,DSX MaxLPS 能够在不增加能耗的前提下大幅提升计算密度,这在行业面临电力和散热瓶颈时至关重要。
英伟达指出,DSX MaxLPS 是 DSX 平台的一部分,该平台还涵盖 Dynamo 推理软件、NeMo 库、NVLink、Spectrum-X 以太网、ConnectX SuperNIC 及 BlueField DPU 等组件,构成从芯片到电网的全栈 AI 工厂方案。

面向未来,英伟达表示在 Vera Rubin NVL72 架构中,DSX MaxLPS 可将单机架 GPU 容量提升最多 40%,Token 吞吐量提升最多 35%,且无需新增电力线路。
此外,英伟达与 Emerald AI 在 Silicon Valley Power 的灵活负荷接入项目中演示了 DSX Flex 的电网协同能力。系统可自动将 AI 工厂功耗从 4 兆瓦降至 3 兆瓦,关键 AI 负载不中断,其余任务暂时挂起,待电网压力缓解后自动恢复。



登录后才可以发布评论哦
打开小程序可以发布评论哦