视频模型为何违反物理?去噪前 10% 已锁死轨迹
linoy_tsaban · x · 2026-09-25
作者指出视频生成模型质量已足够逼真,现在是认真讨论其对真实物理规律忠实度的时候。她引用一篇机理可解释性研究,解释视频模型为何「不懂物理」:
- 关键发现:物体轨迹在去噪过程的前约 10% 就已被锁定
- 成因:RoPE 的空间衰减使其锁到错误位置,导致后续无法修正
- 修复方案:对 rotary embedding 做一行改动即可改善
原论文只在 Wan2.1-1.3B 上验证,作者正在 H3 上用相同提示词测试并复现该修复,检验结论能否泛化到其他模型。
「多模态」频道最新
- 用户用 Recraft V4.1 Flash 生成超现实艺术图 — aziz4ai · 2026-09-25
- AI 生成短片《Morgue Cat》走红 Reddit — Able-Big9639 · 2026-09-25
- H3 分段长视频生成质量衰减,社区尚无完美方案 — Delphoi_Studio · 2026-09-25
- 用 MiniMax H3 生成创意短片《Cocinando con Energia》 — Ok-Nerve941 · 2026-09-25
- 用 GPT-6 Astra 加 Three.js 开源复刻概念 X-16 四排缸引擎 — techartist_ · 2026-09-25
- 几个提示词+参考视频,Claude 产出精细像素风场景 — Charles211 · 2026-09-25