Vera Rubin NVL72 首秀 MLPerf:吞吐量最高达 GB300 NVL72 的 3.7 倍
nordicinst · x · 2026-09-16
NVIDIA 公布 MLPerf Inference v6.1 成绩,Vera Rubin NVL72 系统首次提交预览测试,吞吐量最高比 GB300 NVL72 高出 3.7 倍。
- 扩展效率:288 GPU(四机架 GB300 NVL72)提交实现 99% 扩展效率,吞吐量随硬件增加近线性增长。
- 软件优化:相比 v6.0,软件优化带来最高 1.6 倍性能提升,且提交后仍在持续优化。
- NVIDIA 强调平台通用性:同一套基础设施可跑任意模型与工作负载(训练/推理、语言/视频),保持高利用率,决定推理经济性。
「Infra」频道最新
- 一行命令直取 4 卡 B200:uvx modal shell 实用玩法 — charles_irl · 2026-09-17
- Anthropic 工程师感叹:我只想要五 petaflops 的算力 — charles_irl · 2026-09-17
- El Pulpo 0.1.0 发布:12.7MB 的本地 LLM 代理与负载均衡器 — zaytzev · 2026-09-16
- CPO 峰会共识:光互连规模化的答案不会是单一方案 — BenBajarin · 2026-09-16
- arXiv 新论文提出 Intelligence per Watt:量化本地 AI 的智能能效 — yogthos · 2026-09-16
- 开发者拆解 X 搜索排序架构:双塔检索 + L1/L2 多级排序 — _jaydeepkarale · 2026-09-16