Temporal Context Routing:让音视频生成的镜头与台词对齐剧本时间轴

Yichen Liu · hf · 2026-09-04

Hugging Face 上的新工作提出 Temporal Context Routing(时间上下文路由),针对剧本驱动的音视频联合生成问题:现有方法难以让镜头切换和台词出现精确对齐剧本设定的时间点。

该方法把结构化的剧本时间信息映射到共享的视频-音频时间轴上,从而改善生成结果中镜头时序与对白时机的剧本一致性,补上了剧本驱动音视频生成中缺失的“时间环节”。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →