UMM-Reflection 交错强化学习让多模态模型学会自我修正,GenEval 0.71→0.84

ziqi_huang_ · x · 2026-09-29

Ziqi Huang 团队开源 UMM-Reflection,用交错强化学习教会统一多模态模型生成、反思并重绘图像。由于修正效果只有渲染后才知道,反思文本与图像生成需在整个循环中联合学习。

所属事件:UMM-Reflection 开源,交错强化学习让多模态模型自我修正图像(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →