UniEvo-VL 让图像模型自我纠错,GenEval 从 74.7% 提到 80.8%

mark_k · x · 2026-10-02

新论文 UniEvo-VL 提出多模态自我改进机制:模型生成图像后自我批评找出问题,把反馈转化为纠正性指令;教师版生成器看到这些指令,学生模型只看原始 prompt,通过训练把纠错收益固化进学生模型权重,使改进延续到未来生成。

实验结果(基于 Qwen-Image-2512 + Qwen-VL 反馈):

各任务表现不一,文本渲染任务结果喜忧参半。作者 markk 认为亮点在于把自我批评转化为持久改进:发现错误有用,学会下次避免错误则强大得多。

所属事件:斯坦福推出UniEvo-VL 多模态模型自蒸馏自我进化(4 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →