阿里团队开源 Qwen-Video-Edit:零训练两层投影打通图像与视频潜空间

luisdans · x · 2026-09-04

Qwen 团队(Byp215Bai)发布开源项目 Qwen-Video-Edit,并附技术博客,核心发现:视频潜空间与图像潜空间的差异远小于所有人的直觉假设——一个从未见过视频的图像编辑模型,仅通过两层零训练的投影层就能直接编辑视频生成模型的 latents。

差异并非为零,而是集中在一个非常具体的位置:时间压缩。帖中完整走了一遍测量这种差异的实验链条。

项目已开源:代码在 GitHub,并已集成进 DiffSynth-Studio,附带 ComfyUI 节点和完整安装指南。

所属事件:阿里开源 Qwen-Video-Edit:零训练打通图像与视频潜空间(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →