4GB 显存硬跑 MiniMax H3 视频生成:修好模糊手部要 6 小时渲染一集
unbenannt1 · reddit · 2026-09-08
一位用户在 RTX 3050 Laptop(4GB 显存、WSL2 + ComfyUI)上本地运行 MiniMax H3 的 Ref2VA 多参考图生视频,详细记录了对手部/手指渲染缺陷的排查过程:
- 已确认有效的修复:把 FL2V 权重(minimaxh3fl2vaprunedint8)加载进 MiniMaxH3ReferenceToVideo 多参考节点而非原生 Ref2V 节点,解决了更早的“幽灵手指”缺陷。
- 剩余问题:512x288 分辨率下做手势动作时手部仍糊成一团。Turbo 蒸馏 4/8 步快路径不可用;非官方步数(10 步)更糟;cfg=5.0 产生严重浮雕网格伪影,cfg=2.0 不稳定;30 步无明显改善。
- 真正有效的配置:768x448(H3 的 768p 原生训练短边)+ 无蒸馏 + 无 CFG + 原生 20 步,各手势手部 consistently 成形,但一段 15 秒 362 帧的片段渲染了 6 小时 22 分钟。
- 两段式 draft-then-upscale 也失败:像素空间 RealESRGAN、社区 latent 2x 上采样、tiled diffusion refine 各有硬伤(背景人群畸变、显存估算崩溃、以及一个他自行 root cause 并本地打补丁的 ComfyUI 核心 bug)。
作者仍在探索中间分辨率(608x352、640x384)、蒸馏 LoRA 是否与低分辨率绑死,以及针对 H3 的 attention 后端/torch.compile/量化优化,结论倾向于 4GB 显存可能低于 H3 的现实下限。
「Infra」频道最新
- 黄仁勋确认 GPT-6 Astra 用超 10 万块 Grace Blackwell 训练 — rohanpaul_ai · 2026-09-08
- 32GB 显存跑 Qwen3.8-27B 写代码,社区征集本地模型选型经验 — theexile1337 · 2026-09-08
- 开发者自制 Windows 托盘 NVIDIA 显存监控小工具 — Due-Committee-9591 · 2026-09-08
- LTX2.5 在 Mac 上纯本地生视频,对比 MiniMax H3 的 36GB 门槛 — cocktailpeanut · 2026-09-08
- 用 RL 训 Kimi 基座模型设计变压器,一次推理压缩数周工程 — ycombinator · 2026-09-08
- 去中心化算力市场跑Agent负载,价格比AWS低3至10倍 — DavidLinthicum · 2026-09-08