12GB显存跑MiniMax H3掉速?ComfyUI显存管理问题排查指南
BrooklynBrawl · reddit · 2026-08-06
这篇长文详细复盘了在 12GB 显存的 RTX 4070 Ti 上使用 ComfyUI 运行 MiniMax H3 模型时,遭遇严重生成掉速(从 18秒/步劣化至 400+秒/步)的排查过程。
问题根源
作者发现,掉速的罪魁祸首是 ComfyUI 新版 comfy-aimdo 的 DynamicVRAM 功能。在显存受限且存在已知内存泄漏的情况下,该功能过于激进地分配显存,导致任务溢出到速度极慢的系统共享内存。
解决方案
通过在启动参数中添加 --disable-dynamic-vram 和 --disable-pinned-memory,成功解决了跨会话的显存堆积和掉速问题。文章还分享了处理初期 int8 模型崩溃、OOM(显存溢出)以及配置 SageAttention 的完整踩坑时间线。
「Infra」频道最新
- 开源 LLM 推理引擎 TokenSpeed 加入 PyTorch 生态 — zhyncs42 · 2026-08-06
- DeepSeek v4 Flash架构被低估,Disk KV cache大幅降低推理成本 — teortaxesTex · 2026-08-06
- 废弃天然气井的新使命:转化为甲醇为 AI 数据中心供电 — Ghost_Pilot_MD · 2026-08-06
- FPTalks 2026 聚焦低精度大模型训练 — nmwsharp · 2026-08-06
- Gemma 4 端侧实测:500MB 内存让 iPhone 秒变离线智能助手 — cyb3rops · 2026-08-06
- Targon 上线 Organizations:团队协作与机密计算 — JosephJacks_ · 2026-08-06