MiniMax H3 Ref2V 实操踩坑:3 秒视频生成 15 分钟且音频丢失

yeah280 · reddit · 2026-09-07

一位用户在 ComfyUI 中尝试 MiniMax H3 的 Ref2V 功能做角色/背景替换:输入 3 秒原视频加原音频,用 refvideo0、refaudio0 节点接入,prompt 要求保留原动作、运镜、时序和音频并去除字幕,20 步、24FPS 输出。实测遇到三个问题:原音频未被正确保留、3 秒视频生成耗时约 15 分钟、输出时长与源视频不匹配。作者附上 workflow JSON 求助连接方式是否有误,评论可作 H3 实际能力的参考。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →