接核显当输出,独显显存省出 1~4GB 跑 LLM
paq85 · reddit · 2026-08-23
用户分享了释放 GPU VRAM 给本地 LLM 使用的技巧:将显示器连接到主板的集成显卡(iGPU)接口,让 iGPU 处理 Windows 桌面显示输出。这样可以将独立显卡的全部显存释放出来专门用于 LLM 推理,据称能节省 1 到 4GB 的高性能显存。
「Infra」频道最新
- 内存专家预测:ANN 存储将广泛用于边缘 IoT 与人形机器人 — BenBajarin · 2026-08-24
- Merge Gateway 上 DeepSeek V4 Flash 限时 75 折 — shensi · 2026-08-24
- Antirez 解释 Speculative Decoding 采样机制 — antirez · 2026-08-24
- Hot Chips 峰会解析:为何当下会出现存储芯片短缺 — firstadopter · 2026-08-24
- Φ-Bench 发布:LLM 能否优化自身基础设施? — 青稞AI · 2026-08-24
- 数据中心被妖魔化?美媒指其十年将创收 270 亿美元 — robleclerc · 2026-08-23