伯克利 OmniTaskonomy:19 类图像生成任务如何反哺 25 项视觉理解

Berkeley · hf · 2026-09-30

伯克利团队研究「视觉生成训练何时能提升视觉理解」。

研究设计

关键发现

意义:视觉生成是视觉理解的丰富监督来源,论文给出了通过任务选择与训练课程解锁收益的路线图。项目页:omni-taskonomy.github.io。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →