KAIST 推出 Thinking Reward Model:先定评分细则再审图,开源奖励模型登顶

Xuehai Bai · hf · 2026-09-30

KAIST 团队提出「先思考再打分」(Think Before You Score)范式与 Thinking Reward Model(TRM),改进视觉生成奖励模型。

核心思路

方法亮点

结果

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →