本地跑大模型想合并多卡 VRAM,Reddit 求问何时能开箱即用
PusheenHater · reddit · 2026-09-05
Reddit 用户讨论本地推理的最大瓶颈是 VRAM:用 RAM 替代有性能代价,而把闲置的多张旧 GPU 的显存合并使用,目前只有小众复杂方案,没有 ComfyUI 这类工具里开箱即用的支持。帖子询问这能否成为现实,评论区围绕多卡显存池化的技术难点展开。
「Infra」频道最新
- Omarchy「Burn Bar」可视化监控 Claude/Codex 用量与 GPU 状态 — DanWahlin · 2026-09-05
- Reddit热议:数据墙逼近,Test-Time Compute成行业新范式 — erdematar · 2026-09-05
- 腾讯混元 Hy4 预览:770B 总参 49B 激活,原生 1M 上下文 Apache 2.0 — aftahi_ai · 2026-09-05
- Qwen3.8 27B 量化版挤进 24GB 显存跑 10 万上下文,本地模型威胁前沿定价 — ChopSticksPlease · 2026-09-05
- Speechify CEO 谈自建数据中心、被 ElevenLabs 反超与千万美元人才战 — 20VC · 2026-09-05
- 他把本地 LLM 当 3D 打印机用:一年自写 12 个游戏、29 个游戏 Mod — Quebber · 2026-09-05