vLLM 支持 RAM offload,4 张 R9700 本地跑通 DeepSeek-V4 视觉实验版

sloptimizer · reddit · 2026-09-30

Reddit 用户 sloptimizer 分享:得益于 tcclaviger 的贡献,vLLM 新增了 RAM offloading 支持,让前沿大模型在本地部署变得可行。作者成功在 4 张 AMD R9700 上运行了原始的 DeepSeek-V4-Flash-Vision-Exp。

帖内附完整可复制的 podman 启动命令,关键参数包括:

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →