开发者从零自训视频扩散模型:先学运动再模仿原片

pixlpa · x · 2026-09-11

开发者 pixlpa 分享自己从第一性原理出发训练视频生成模型的进展:采取「运动优先」(motion first)的思路,让扩散模型先学会生成帧间运动数据。目前模型生成的运动数据已足够逼真,能较好地模仿参考视频片段的动态效果。他还在帖子续文中表示,下一步计划让流程实时运行,并开放可控参数,尝试更有趣的反馈回路。

所属事件:开发者一夜自训光流扩散模型学会视频运动(4 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →