vLLM 上线 Vera Rubin NVL72 支持,单卡吞吐达 GB200 的 7.8 倍

vllm_project · x · 2026-10-10

vLLM 团队联合 NVIDIA、Red Hat、Inferact 宣布已完成对 NVIDIA Vera Rubin NVL72 的支持,并提供每日构建的容器镜像(vllm/vllm-openai:cu134-nightly),今天即可运行 DeepSeek、Kimi、GLM、MiniMax 等模型。

关键信息:

所属事件:vLLM 完成 Vera Rubin NVL72 支持,吞吐超 GB200 达 7.8 倍(7 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →