接核显当输出,独显显存省出 1~4GB 跑 LLM

paq85 · reddit · 2026-08-23

用户分享了释放 GPU VRAM 给本地 LLM 使用的技巧:将显示器连接到主板的集成显卡(iGPU)接口,让 iGPU 处理 Windows 桌面显示输出。这样可以将独立显卡的全部显存释放出来专门用于 LLM 推理,据称能节省 1 到 4GB 的高性能显存。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →