ComfyUI 跑通 MiniMax H3 教程:T2V/I2V 从模型文件到参数全流程

Fun_Walk_4965 · reddit · 2026-08-27

一篇手把手的 ComfyUI MiniMax H3 入门教程,覆盖文生视频(T2V)与图生视频(I2V)快速上手。

所需文件:diffusion model 用 minimaxh3fl2vaprunedint8convrot.safetensors,文本编码器为 Qwen3-VL-32B 的 NVFP4 AWQ 量化版,另需视频 VAE 和音频 VAE 两个文件;可选 Turbo LoRA(8 步加速)。

关键参数:T2V 起点 1344×768、24 FPS、20 步。FL2VA 检查点统一支持:0 图=T2V,1 图=首帧或尾帧 I2V,2 图=首尾帧生成。注意 H3-Base 短边为 768px、宽高需 32px 对齐、帧数遵循 H3 时间网格;H3 生成音画一体,没声音时先查音频 VAE 是否接到了最终保存节点。作者建议按 T2V → 单图 I2V → 进阶功能的顺序渐进。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →