作者公开 ComfyUI 视频工作流:双角色参考+语音对嘴保持一致性
boricuapab · reddit · 2026-09-06
作者分享其为一次 sync challenge 创作镜头所用的 ComfyUI 完整工作流:使用 h3 t2va 模型生成视频,搭配 ref2v acc LoRA 与 LTX2.5 放大器,并用 2 张角色参考图保证跨镜头角色一致性。
音频一致性方面,作者录制了自己的声音作为男性角色的语音参考,实现嘴型与声音对齐。工作流文件(含 2 张角色参考图)已通过 Ko-fi 链接公开,用户只需自行录制一段语音即可复现整个流程。
「多模态」频道最新
- 扩散语言模型LLaDA推出图像编辑新模型待实测 — Slight_Tone_2188 · 2026-09-06
- 5060 Ti 实测图像工作流:29秒出图并手动清理 — thatguyjames_uk · 2026-09-06
- Midjourney 实战技巧:抹掉面部细节,用剪影撑起卡通情绪 — tisch_eins · 2026-09-06
- 两人花12天3000元额度,用Codex+Seedance复刻沙丘质感AI短片 — APPSO · 2026-09-06
- 超现实 AI 视频:盐滩脚印下藏着微型火车站,附完整 prompt — umesh_ai · 2026-09-06
- uncomfymcp:免导出工作流、对话即画图的极简 ComfyUI MCP 服务 — citrainmyhefeweizen · 2026-09-06