MiniMax H3 实战:REF2VA 画质+FL2VA 音质+LightX2V 提速的组合工作流
gabxav · reddit · 2026-09-05
作者 gabxav 分享 MiniMax H3 发布以来的实测心得,发现 REF2VA 与 FL2VA 两种模式各有强弱,并给出取长补短的 ComfyUI 工作流。
实测结论
- REF2VA:视觉质量明显更好,皮肤纹理、光照、环境更自然。
- FL2VA:整体偏“过度平滑”,AI 感更重,但处理大幅运动的角色更好,且语音/音频克隆质量显著更优(更少的回声、噪声和伪影)。
组合工作流
- REF2VA 负责主视频生成(画质)
- FL2VA 负责音频精修
- LightX2V 8-step LoRA 大幅提速
- H3 AudioRefine 节点把生成音频再过一遍 FL2VA 得到更干净音质
作者附上了全部复现资源:H3 模型与 LoRA 的 Hugging Face 下载、ComfyUI workflow JSON、语音/图像参考文件、KJNodes 与 AudioRefine 节点。性能参考:RTX 5090 上一段视频生成耗时 198.4 秒。
「多模态」频道最新
- Seedance 2.5 求婚场景实测:情绪递进与空中物理都成立 — azed_ai · 2026-09-05
- H3 末日短片:女孩在丧尸围城中找回挚友 — ArjanDoge · 2026-09-05
- 微调 Meta SAM 3 解决图文排版难题,自动找文案留白区 — andrew_n_carr · 2026-09-05
- 开发者分享 Astra 玩法:Blender 黏土渲染接视频扩散模型做短片 — OdinLovis · 2026-09-05
- Reddit 实测对比 MiniMax H3 Turbo 两条加速 LoRA 的画质差异 — No-Bee-231 · 2026-09-05
- Reddit 分享 AI 短片《Ishiro - The Last Blade》 — Nervous-Barnacle-888 · 2026-09-05