Nebius GB300 NVL72 整机架登顶 MLPerf:DeepSeek R1 每秒 60.3 万 tokens

demian_ai · x · 2026-09-18

Nebius 在 MLPerf Inference v6.1 中拿下 5 个第一:72 卡 GB300 NVL72 整机架在 DeepSeek R1 的 server 与 offline 场景均夺魁,分别约 60.3 万与 69 万 tokens/秒,gpt-oss 120B 推理速度突破每秒 100 万 tokens。Nebius 是本轮仅有的两家提交 Vera Rubin NVL72 预览成绩的实验室之一。

作者给出关键数据:从 8 卡扩展到 72 卡(近 9 倍),速度也近乎线性增长近 9 倍——「单卡快容易,扩展后还快的整机架才是产品」。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →