阿里团队开源 Qwen-Video-Edit:零训练两层投影打通图像与视频潜空间
luisdans · x · 2026-09-04
Qwen 团队(Byp215Bai)发布开源项目 Qwen-Video-Edit,并附技术博客,核心发现:视频潜空间与图像潜空间的差异远小于所有人的直觉假设——一个从未见过视频的图像编辑模型,仅通过两层零训练的投影层就能直接编辑视频生成模型的 latents。
差异并非为零,而是集中在一个非常具体的位置:时间压缩。帖中完整走了一遍测量这种差异的实验链条。
项目已开源:代码在 GitHub,并已集成进 DiffSynth-Studio,附带 ComfyUI 节点和完整安装指南。
所属事件:阿里开源 Qwen-Video-Edit:零训练打通图像与视频潜空间(2 条相关)→
「多模态」频道最新
- 用户实测称 GPT-6 Astra 3D 建模强到天天开 Blender — flavioAd · 2026-09-04
- Makepad flow:Rust 单可执行文件版 ComfyUI 一天造出 — anselm · 2026-09-04
- RTX 4060 Ti 16GB 本地跑 MiniMax 视频模型,768p 五秒仅需三分钟 — aziib · 2026-09-04
- LTX 2.5 成 AI 音乐视频创作热门,Mac 上流畅无卡顿 — cocktailpeanut · 2026-09-04
- 「真想活成 AI」:MiniMax H3 生成像素风少女引热议 — aziz4ai · 2026-09-04
- MiniMax H3 生成真人级像素感短片,Magnific 放大工作流亮相 — MarioKrenn6240 · 2026-09-04