UniEvo-VL:多模态模型用自身反馈提升图像生成能力

StanfordAILab · x · 2026-10-05

Stanford AI Lab 转发的最新研究 UniEvo-VL 探索:当生成与理解统一于同一多模态模型时,模型能否给自己的生成结果打分,并把这种评估能力转化为训练信号(on-policy 自蒸馏),实现自我改进。

基于 Qwen-image-2512 构建,效果提升明显:

结果表明自生成反馈确有训练价值,但其适用边界同样值得注意。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →