vLLM 线程(2/5):Rubin NVL72 两项基准成绩详解

vllm_project · x · 2026-10-10

vLLM 官方线程第二部分给出数据来源:SemiAnalysis AgentX 基准上,vLLM 服务 MiniMax M3 于 Vera Rubin NVL72 在同等交互性下吞吐超 GB200 7.8 倍;MLPerf Inference v6.1 中,vLLM + Dynamo 在 Qwen3-VL-235B-A22B 上达到 GB300 NVL72 最高 3.7 倍吞吐。

所属事件:vLLM 完成 Vera Rubin NVL72 支持,吞吐超 GB200 达 7.8 倍(7 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →