开发者自训「运动优先」光流扩散模型生成视频

开发者 pixlpa 分享了一个反常规的自训视频生成管线:在大量视频的光流图上训练扩散模型,另用视频帧训练一个小型 latent diffusion model。生成时以 64px 的当前帧图像做条件保留图像内容,用帧间流场扭曲生成图来保证视频连续性,体现了「运动优先」而非「图像优先」的构建思路。

2026-09-23 ~ 2026-09-23 · 2 条相关