3090+魔改64GB CMP 170HX 双卡跑 H3 频遇 OOM,求固定显存分配方案
JustinPooDough · reddit · 2026-09-06
一位 Reddit 用户在 ComfyUI 中用 24GB 的 3090 加解锁到 64GB 的 CMP 170HX 双卡运行 Minimax H3(NVFP4 剪枝版)与 Qwen3-VL-32B。他计划把扩散模型与 VAE(BF16,约 46GB)固定在 CMP 170HX、文本编码器(约 16GB)固定在 3090,理论上显存充足,但用 --highvram 启动后 3090 仍报 OOM;不用该标志虽能跑但单次生成超 15 分钟。帖子询问如何把各组件钉在指定 GPU 上避免 offloading,CMP 170HX 的 PCI-E 2.0 4x 慢速带宽也是限制因素。
「Infra」频道最新
- GPU 租用哪家稳:giffmana 建议考虑 Thunder/RunPod,月花费超 $1000 — giffmana · 2026-09-06
- 「芯片版 OpenRouter」被认为是价值百亿美元级的机会 — mishig25 · 2026-09-06
- NYT 调查:被制裁浪潮集团借美国子公司 Aivres 续购 Nvidia 顶级 AI 芯片 — ShakeelHashim · 2026-09-06
- 开源脚本让旧安卓变身 GPU 加速 Linux 桌面或智能家居服务器 — tom_doerr · 2026-09-06
- 两块"奶奶级"P40 跑出 48 tok/s:老显卡llama.cpp 调优实录 — Jumpy-Operation-4615 · 2026-09-06
- Baseten 工程师出书《Inference Engineering》附学习资源清单 — kmeanskaran · 2026-09-06