VGI-Bench:探查视频生成模型视觉智能的新基准

_akhaliq · x · 2026-08-28

VGI-Bench 是一个旨在超越感知质量、探查视频生成模型视觉智能能力的评测基准。该基准包含 27 个任务和 810 个实例,评估模型是否能对演变中的视觉过程进行推理。测试结果显示,尽管当前模型展现出一定的视觉推理能力,但距离可靠性仍有较大差距——表现最好的模型得分仅为 51.0%。该基准旨在揭示视频生成模型在推理方面的优势与短板。

所属事件:VGI-Bench 发布:评测视频生成模型视觉推理能力(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →