研究:视频扩散模型缺乏可扩展的串行计算能力

marksaroufim · x · 2026-07-20

一项名为《视频扩散模型中的串行性差距》的研究指出,尽管常有人称“视频模型是世界模拟器”,但标准的视频扩散模型在处理长链条的依赖事件(如多球连续碰撞)时会失效。

研究发现,模型去噪步骤本质上只是一种循环计算,而非串行计算,因此无法随着计算量的增加而提升推理能力。这意味着单纯增加算力并不能解决视频模型在复杂物理推理上的缺陷。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →