LIFT 论文:末帧布局控制大幅视角变化下的未来布局视频生成
_akhaliq · x · 2026-10-09
新论文 LIFT(Layout-In-Future Video Generation)提出统一视频生成框架,通过 On-Policy Self-Distillation 实现大幅视角变化下的布局控制:
- 联合控制:仅用末帧布局,同时控制相机运动与新露出区域的语义-空间构图
- 双模式 OPSD 训练:用密集时空布局教师训练共享学生模型,支持仅相机轨迹条件与相机+布局双条件两种模式
- LIFT-Vista 数据集:新整理的大视角变化数据集,含相机与布局联合标注
「多模态」频道最新
- GPT-6 Image 2.5 复刻 1940 年代中国乡村新闻片质感 — DeryaTR_ · 2026-10-09
- Vigglorious Studio:分块+引导关键帧,让长视频角色一致性大幅提升 — Tablaski · 2026-10-09
- 星球大战 AI 神曲再出新作:Qui-Gon 的《Gin and Juice》 — aronchick · 2026-10-09
- MiniMax H3 生成僵尸短片走红,AI 视频再出爆款 — gabxav · 2026-10-09
- Seedance 2.5 AI 视频被赞「杰作」,转发者附和推荐 — BLUECOW009 · 2026-10-09
- HeyGen Video 登顶 OpenRouter 视频模型榜,48 小时发放免费码 — aziz4ai · 2026-10-09