ComfyUI 实测 MiniMax H3:视频音频同步生成
GamerVick · reddit · 2026-08-04
作者分享了在 ComfyUI 中使用 MiniMax H3 模型渲染视频的实测体验。
关键信息:
- 采用 T2VA / FL2VA pipeline,实现了单次生成中视频与音频的同步输出,效果令人印象深刻。
- 基于参考视频工作流生成画面,音频部分则交由 Suno 处理。
- 帖内附带了完整的模型文件配置,包括量化处理后的 UNet/DiT、文本编码器以及视频/音频 VAE。
所属事件:MiniMax H3 模型实测:ComfyUI 实现视频音频同步生成(2 条相关)→
「多模态」频道最新
- Reddit 说 MiniMax H3 限制很少,还能稳定生成 10 秒视频 — bickid · 2026-08-04
- MiniMax H3 黑位丢细节?有人用 contrast 节点修回来 — Cequejedisestvrai · 2026-08-04
- NVIDIA 把 NemotronLabs VoiceChat 11B 放上了 Hugging Face — adefa · 2026-08-04
- MiniMax H3 视频生成实测:4070 Super 做 10 秒片段要 546 秒 — anyup88 · 2026-08-04
- MiniMax H3 文生图实测:3090 Ti 跑 10 秒要 8 到 9 分钟 — iChrist · 2026-08-04
- Reddit 用户称找到 MiniMax H3 免费 2 倍加速法并附教程 — foxdit · 2026-08-04