ECCV 2026 论文:视频模型推理发生在去噪步骤而非帧间

liuziwei7 · x · 2026-08-28

ECCV 2026 录用论文《Demystifying Video Reasoning》挑战了现有认知。研究发现,扩散视频模型的推理能力并非如先前假设的那样在视频帧之间展开 (Chain-of-Frames),而是主要沿着扩散去噪步骤逐步进行。

核心发现:

基于这些发现,论文提出了一个无需训练的集成方法 (TFE) 来增强推理能力。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →