有人想要的视频模型:文本加前后三帧一起控制

Select_Butterfly_387 · reddit · 2026-07-21

帖子在讨论视频模型应当支持的输入能力:希望模型能同时接收 文本提示词 + 前三帧,最好还能再加上 后三帧。

这本质上是在提出一个视频生成/编辑模型的功能需求:通过同时约束片段开头和结尾,来更好地控制运动与过渡。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →