自训光流扩散模型:用帧间流场扭曲生成图实现视频连续性

pixlpa · x · 2026-09-23

开发者 pixlpa 分享了一个自训视频生成管线:在大量视频的光流图上训练扩散模型,另用视频帧训练一个小型 latent diffusion model(LDM)。生成时 LDM 先出图,再用流模型按光流扭曲该图以保持帧间连续,被遮挡区域由 LDM inpainting 补全。流模型还以当前帧的 64px 缩略图作条件,增强对图像内容的感知,并参考前 4 帧的光流保证时序连贯。

所属事件:开发者自训「运动优先」光流扩散模型生成视频(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →