vLLM 线程(2/5):Rubin NVL72 两项基准成绩详解
vllm_project · x · 2026-10-10
vLLM 官方线程第二部分给出数据来源:SemiAnalysis AgentX 基准上,vLLM 服务 MiniMax M3 于 Vera Rubin NVL72 在同等交互性下吞吐超 GB200 7.8 倍;MLPerf Inference v6.1 中,vLLM + Dynamo 在 Qwen3-VL-235B-A22B 上达到 GB300 NVL72 最高 3.7 倍吞吐。
所属事件:vLLM 完成 Vera Rubin NVL72 支持,吞吐超 GB200 达 7.8 倍(7 条相关)→
「Infra」频道最新
- Fireworks AI 遭内部凭据未授权使用,官方确认安全事件并展开调查 — lqiao · 2026-10-10
- ChapterPal 确认支持 Android 端离线 Gemini Nano,AI 导师可无网使用 — burkov · 2026-10-10
- 对话式 AI 或 1-2 年内过时,Agent 蜂群将推高流量千倍 — dumpshoot · 2026-10-10
- Starship 发射成本有望降至 18.5 万美元,入轨价格缩水百倍 — claud_fuen · 2026-10-10
- 数据中心明星公司 300 亿美元 IPO 梦碎,48 小时内崩塌 — mfiguiere · 2026-10-10
- DuckDB v2.0 CLI 推出 Agent 模式,token 消耗直降 59% — josh_wills · 2026-10-10