ComfyUI 视频生成实验:音频与图像参考工作流

TensorTinkererTom · reddit · 2026-08-26

作者分享了使用 ComfyUI 进行的 MM(参考图像和音频)实验视频。尽管视频编辑粗糙且音频存在频繁故障,但主要展示了工作流细节:主要使用 20 步的 out-of-the-box ComfyUI 工作流程,并添加了音频节点。使用了 Load Video 节点获取前一个视频的最后 24 帧以尝试延续视频(效果有限)。作者还提到了在制作一半后引入了 4 步 LoRA,即使在低权重下,音频故障依然频繁,但视频质量通常尚可。附带了部分片段和角色替换的 Pastebin 链接。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →