图像编辑模型直改视频 latent:Qwen-Video-Edit 零训练实现

qixing_huang · x · 2026-09-04

Qwen-Video-Edit 项目发现:视频 latent 空间与图像 latent 空间的差距远比大家以为的小——小到一个从未见过视频的图像编辑模型,只需两个零训练的投影层,就能直接编辑视频生成模型的 latent。\n\n但差距也并非为零:它藏在一个非常具体的位置——时间压缩(temporal compression)。博客完整复盘了作者测量这一差距的实验链条,以及由此诞生的开源项目 Qwen-Video-Edit。\n\n项目已开源代码,并集成进 DiffSynth-Studio,附带 CommpiUI 节点和完整安装指南。

所属事件:阿里开源 Qwen-Video-Edit:零训练打通图像与视频潜空间(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →