NVIDIA DSX:固定电力预算多榨 24% token 吞吐

NVIDIA Blog · rss · 2026-09-16

NVIDIA 在 AI Infra Summit 上重点介绍 AI 工厂效率平台 DSX,核心理念是「每兆瓦产出更多 token」。

电力灵活性已投产:Santa Clara 的 Silicon Valley Power 与 Emerald AI 合作,NVIDIA Eos AI 工厂运行 Conductor 平台,已响应 200+ 次电网需求信号,功率从 4MW 自动降到 3MW,高优先级任务不受影响,全程无人工干预。

DSX MaxLPS 首次实测:Lambda 在 5 机柜 19 节点的 HGX B200 集群上,用原本 16 节点的电力预算跑 19 节点,集群 token 吞吐提升 24%(约 400 万→500 万 tokens/s),每瓦性能提升 23%。NVIDIA 预估 Vera Rubin NVL72 工厂同功率预算可多承载 40% GPU 容量。

DSX 平台全貌:MaxLPS(动态功率分配)、Flex(响应电网信号调度负载)、OS(开源工厂生命周期管理)、Sim(部署前仿真)、Reference Designs(验证架构),并将 800V DC 供电纳入参考设计。

黄仁勋此前表态:「1GW 工厂不会变成 2GW」,答案是整体设计而非局部优化。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →