MovieGrid 多网格后训练法,让长视频多镜头生成更连贯
Jiawei Mao · hf · 2026-09-09
Jiawei Mao 团队在 Hugging Face 发布 MovieGrid,提出 Multi-Grid 后训练方法用于长视频多镜头生成。核心思路是把长视频分解为空间排列的多个块(chunks)进行联合建模,从而提升多镜头间的连贯性,并能高效扩展生成视频的长度。
「多模态」频道最新
- Mask Forcing:双噪声掩码蒸馏缓解自回归视频扩散模式坍塌 — Zhuoran Zhao · 2026-09-09
- 新图像模型引发刷屏级沉迷,圈内人集体上头 — Dimillian · 2026-09-09
- 重度 Grok Bot 用户对比 Meta Muse:第一印象实测出炉 — Scobleizer · 2026-09-09
- fal 研究者将亮相巴黎 Three.js 大会,三场活动覆盖视频模型训练与 AI+3D — OdinLovis · 2026-09-09
- 网友用 MiniMax H3 图生视频复刻 GTA VI 像素风动画 — Time-Ad-7720 · 2026-09-09
- Blender 黏土模型经 Seedance 2.5 变实拍,效果惊艳 — aftahi_ai · 2026-09-09