功率共享让192块GB3跑进原140块GPU预算,吞吐增49%
julsimon · x · 2026-09-28
julsimon 引用 NVIDIA 与 Nscale 9月27日的测试数据:140 块 GB300 GPU 仅用掉 264.4 kW 电力预算中的 166.2 kW。启用功率共享后,同一预算可容纳 192 块 GPU,每秒 token 吞吐提升 49.2%,但最慢的 1% 请求延迟增加 17%。作者指出:AI 的电力短缺,一部分其实是被预留却从未用上的电力。
「Infra」频道最新
- 史上最大规模建设进行中:AI 数据中心正把智能变成制造业 — Dr_Singularity · 2026-09-28
- 曝 Anthropic 对 NVIDIA 合同承诺金额已超 1800 亿美元 — zephyr_z9 · 2026-09-28
- Friedberg:开源模型让 90% 的 AI 用途不再需要数据中心 — MarvinTBaumann · 2026-09-28
- 老 infra 工程师吐槽:PB 级日志分析我们十几年前就用 Hadoop 干完了 — basedjensen · 2026-09-28
- async zstd 慢 23 倍之谜:Node 修复未声明输入大小的隐藏代价 — AI Snake Oil · 2026-09-28
- 用范畴论给深度学习画图:PyNCD 把 FlashAttention 画在餐巾上 — GioeleZardini · 2026-09-28