Reddit 用户实测:一个节点让 MiniMax H3 在 5090 上告别 OOM
denizbuyukayak · reddit · 2026-09-06
作者升级到 32GB RTX 5090 后,用 ComfyUI 生成 MiniMax H3 视频仍频繁 OOM,试遍 --disable-pinned-memory、--vram-headroom 等参数两周无果,最终靠 H3 Optimizations 节点包(github.com/Zironic/H3-Optimizations)解决:在 Basic Guider 前插入 "H3 Memory Optimization" 节点,配合默认 pinned-memory/dynamic-vram 和 Comfy Kitchen Attention(ModelAttentionBackend 节点),可稳定生成 15 秒 2K 视频,采样时还剩约 8GB 显存,速度零损失。
作者还分享了自己的速度+质量最优组合:
- ComfyUI 原生 i2va/re2va
- MiniMax-H3-Acc-LoRAs(可从 Kijai 的 HuggingFace 仓库下载,ComfyUI 原生 Load LoRA 节点已支持,超过 8 步质量会下降)
- Comfy Kitchen Attention
- Spectrum(32GB 显存下可把 historystorage/offlinearchivestorage 设为 VRAM 加速出片)
另附避坑提示:最新 ComfyUI 0.5.x 版本会在采样 2-3 步后抛出严重 CUDA 错误,建议暂留 0.4.15 版本。
「Infra」频道最新
- 近乎一本书的虚拟内存长文:页表、TLB、NUMA 与性能优化全拆解 — abhi9u · 2026-09-06
- Qwen3.8 Flash 本地实测:M4 Max 跑 45 tok/s 接近 27B 速度 — DerTomsn · 2026-09-06
- Altman 算账:3.8 万次 ChatGPT 查询才耗水一颗加州杏仁 — victor_explore · 2026-09-06
- 从第一性原理吃透 KV Cache:一份覆盖 MHA/GQA/MLA 到 PagedAttention 的技术手册 — techNmak · 2026-09-06
- 双 GB10 桌面级方案,称可跑当前最强本地模型 — jasonkneen · 2026-09-06
- Agent 时代 KV cache 挤爆 HBM,容量不足拖垮有效带宽 — AccBalanced · 2026-09-06