Ego2Act 基准:测 6 个 SOTA 视频模型能否执行多步动作达成目标

mohitban47 · x · 2026-10-05

研究者发布 Ego2Act,一个新的目标导向视频生成基准,把视频生成评估从"未来画面看起来是否合理"推进到"模型能否执行多步动作来达成目标"。

所属事件:Ego2Act 基准发布:6 个 SOTA 视频模型仅完成 67.8% 任务(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →