NVIDIA阐述AI工厂每瓦性能指标
NVIDIA Blog · rss · 2026-07-14
NVIDIA 发表文章强调,每瓦性能是衡量 AI 基础设施效率的终极指标,直接决定了 AI 工厂在固定电力预算下的营收与利润。
- 架构优势:随着前沿模型转向 MoE 架构,NVIDIA Blackwell NVL72 平台通过软硬件协同设计,在 DeepSeek、GLM 和 Kimi 等模型上实现了远超 Hopper 的每瓦性能。
- 软件优化:结合 NVFP4 量化、 disaggregated serving(分离式推理)及 KV cache offloading 等技术,大幅提升单 GPU 性能。
- 能效管理:通过 DSX MaxLPS 平台实时调配 GPU 功率并支持液冷,使运营商在同等电力预算下可增加多达 40% 的 GPU 运行数量。
- 生产验证:Anthropic、OpenAI、CoreWeave 等厂商已采用该平台进行大规模推理服务。
「Infra」频道最新
- Oracle Q1 云基建收入三位数增长,AI 算力需求持续爆发 — DavidLinthicum · 2026-09-11
- SF Compute 创始人:现在买算力是「绝对糟糕的体验」 — IgorCarron · 2026-09-11
- 开源 SmolVM:2026 年 Agent 不止用浏览器,而是拥有整台电脑 — aniketmaurya · 2026-09-11
- PyTorch Day Korea 2026 首届线下大会启动,9月13日截止征集演讲 — PyTorch · 2026-09-11
- 本地跑 LLM 选卡:4 张 CMP-170HX 涨价 vs Mac Studio M5 — rumboll · 2026-09-11
- llama.cpp 为 RDNA4 调优 Flash Attention,大上下文提升明显 — pmttyji · 2026-09-11