DeepSeek v4 与 GLM 推理速度跑赢 vLLM 和 SGLang

jedisct1 · x · 2026-09-09

开发者 steeve 发推称,现在 DeepSeek v4 和 GLM 在其推理栈上的运行速度已经超过 vLLM 和 SGLang 两大主流推理框架,并表示功能层面还有大量工作要做,但性能已经到位。这是关于新一代开源大模型推理性能的重要第三方实测信号。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →