UMM-Reflection:交错强化学习让统一模型自我反思修图,GenEval 提升 12 分

Yijia Fan · hf · 2026-09-29

统一多模态模型既能理解也能生成图像,理论上可以诊断自己的生成结果并迭代修复,但反思文本与图像生成需要联合学习。研究团队提出 UMM-Reflection,用强化学习优化完整的反思-生成轨迹:

在 BAGEL 上,UMM-Reflection 较 SFT 在 GenEval 上提升 12.05 分,且增益迁移到 WISE(+10.97)、OneIG-Bench(+3.48)、T2I-CompBench++(+4.63)等未参与训练的基准。

所属事件:UMM-Reflection 开源,交错强化学习让多模态模型自我修正图像(3 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →