视频模型视觉推理基准 VGI-Bench:Seedance 暂居首

青稞AI · wechat · 2026-09-01

针对视频生成模型是否具备“通过生成进行视觉推理”的能力,研究团队构建了包含 27 个任务、810 个样本的 VGI-Bench 基准。评测结果显示,模型已具备初步视觉推理能力,但距离稳定可靠仍有差距。

排名前三:Seedance 2.0 (51.0分), MiniMax-H3 (44.4分), Kling 3.0 (44.0分)。

关键发现:

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →