Stanford NLP 推出 UniEvo-VL:自蒸馏训练让多模态模型自我进化

stanfordnlp · hf · 2026-10-01

Stanford NLP 发布 UniEvo-VL,一种无需外部教师的「在-policy 自蒸馏」训练方法:同一多模态模型既当老师又当学生,老师能看到模型自己的批评作为特权信息,学生只看原始问题,训练最小化两者扩散分布的差异。基于开源 Qwen-image-2512,GenEval 从 0.747 提升至 0.808,GenEval2 Soft-TIFA 从 32.97 提升至 35.53。实验还表明,更强的外部评审(如 GPT5.6-Luna)意味着更高的自进化上限;文本渲染任务上的提升并不均匀。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →