图生视频延长与色彩一致性:ComfyUI 工作流参数详解
Dependent_Revenue_16 · reddit · 2026-08-09
作者分享了使用视频生成模型制作 AI 视频的进阶工作流,重点解决了延长视频片段时保持色彩和音频一致性的问题。
核心技术点:
- 视频延长与过渡:使用图生视频模型,将上一段视频的最后几秒作为新片段的起始 latent,并遮盖前面的部分以避免音频断层。同时引入新的提示词和低分辨率参考视频来控制构图。
- 提示词迭代与放大:第一遍以低分辨率(480p)跑 20 步快速调整提示词;第二遍进行 720p 放大(0.75 降噪,8 步),通过解码重编码的方式在消除瑕疵的同时保持原有构图。
作者在 RTX 5090 上生成 18-20 秒的片段大约需要 10 分钟。
「多模态」频道最新
- SIGGRAPH Asia 2024:TriHuman 实时高保真数字人渲染新架构 — chrisgrayson · 2026-08-09
- 用 Google Gemini 生成 1947 年罗斯威尔 UFO 坠毁现场复古视频 — michaelrabone · 2026-08-09
- 仅凭提示词生成 30 秒 16mm 胶片质感短片,实测 Seedance 2.5 — SimplyAnnisa · 2026-08-09
- WanGP 运行 FL2VA 模型出现画面异常,低显存设置或是元凶 — Bulky-Schedule8456 · 2026-08-09
- 本地 3090 跑 Minimax 视频模型,实测动画与音效惊艳 — tranvuong0402 · 2026-08-09
- Seedance 2.5 视频生成实测:精准呈现空间与情绪递进 — CurieuxExplorer · 2026-08-09