Wan 2.2 声图生视频 ComfyUI 工作流教程

CryptoCatatonic · reddit · 2026-07-16

本教程详细演示了如何在 ComfyUI 中搭建并使用 Wan 2.2 S2V(声图生视频)模型的工作流。 核心工作流功能包括: - **多模态输入**:支持结合参考图像与视频素材进行生成。 - **语音同步**:集成 Kokoro 文本转语音模型,实现视频角色的精准对口型。 - **动作控制**:利用 DW Pose 实现更精细的角色动作控制。 - **特效拓展**:介绍了如何在不破坏原模型口型同步的前提下,生成超出参考图原本视觉效果的额外画面。

所属事件:Wan 2.2声图生视频ComfyUI实战教程发布(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →