Stanford NLP 推出 UniEvo-VL:自蒸馏训练让多模态模型自我进化
stanfordnlp · hf · 2026-10-01
Stanford NLP 发布 UniEvo-VL,一种无需外部教师的「在-policy 自蒸馏」训练方法:同一多模态模型既当老师又当学生,老师能看到模型自己的批评作为特权信息,学生只看原始问题,训练最小化两者扩散分布的差异。基于开源 Qwen-image-2512,GenEval 从 0.747 提升至 0.808,GenEval2 Soft-TIFA 从 32.97 提升至 35.53。实验还表明,更强的外部评审(如 GPT5.6-Luna)意味着更高的自进化上限;文本渲染任务上的提升并不均匀。
「多模态」频道最新
- Aiden Bai 用一段 prompt 让 AI 生成 30 秒游戏预告片,含原创音乐与音效 — aidenybai · 2026-10-01
- 网友用MiniMax H3制作IronHide变形金刚视频 — ChaoticBlast · 2026-10-01
- 艺术家用神经细胞自动机+Gemini 天气系统打造数字生态 nom nom — zzznah · 2026-10-01
- 用户吐槽 Suno v6 表现太差,音乐生成口碑存疑 — hq4ai · 2026-10-01
- 循环复用 Transformer 块:260M 小模型以 4.9 倍低算力胜过 6.5 倍大模型 — arankomatsuzaki · 2026-10-01
- Runway 峰会放出神秘项目 Continuum 抢先预览 — c_valenzuelab · 2026-10-01