双 RTX 6000 Ada 本地跑 DeepSeek 遭遇显存与框架兼容坑

EggDroppedSoup · reddit · 2026-08-03

一位开发者发帖求助,在使用两张 RTX 6000 Ada 显卡本地部署 DeepSeek 模型时遇到瓶颈。尝试在 SGLang 和 vLLM 框架下开启 dSpark 均告失败,测试社区版 NVFP4 量化也问题频发,目前仅 MXFP4 精度能在关闭 dSpark 时勉强运行,寻求社区的配置经验与最佳实践。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →