6GB 显存跑通对口型工作流:本地加载、唇形同步走 API

Extreme-Shock1930 · reddit · 2026-10-01

作者反感动辄 40 节点的 talking head 工作流,反其道搭建了最小图:加载视频、加载音频,加一个 sync 自定义节点组(video in、audio in、API key、generate、output、save),即可把 5 秒片段加配音变成对口型视频。

加载和预览在 3060 上跑,显存几乎不动;真正的唇形同步是托管 API 调用,本地 GPU 性能无关紧要,按输出秒数付费,省去等显存。

他还在琢磨两个问题:如何缓存结果避免图重跑时同一段重复计费;API key 应放图 JSON 里还是环境变量。并征求大家对工作流中本地与托管环节怎么切分的经验。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →