COLM 海报 #60:推理模型爱放大的行为 ≠ 真正带来好结果的行为

Jeande_d · x · 2026-10-09

作者在 COLM 会议展示一张海报(#60,Imperial Ballroom),核心发现是:思考型模型(thinking models)倾向于放大的行为,与真正驱动正面结果的行为之间存在错位——也就是说模型「喜欢做」的不一定是「有效」的。

对训练与评测有参考意义:如果 RL/推理训练放大的是模型偏好而非真正有效的行为模式,可能带来系统性偏差。细节需看海报原文。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →