COLM 海报 #60:推理模型爱放大的行为 ≠ 真正带来好结果的行为
Jeande_d · x · 2026-10-09
作者在 COLM 会议展示一张海报(#60,Imperial Ballroom),核心发现是:思考型模型(thinking models)倾向于放大的行为,与真正驱动正面结果的行为之间存在错位——也就是说模型「喜欢做」的不一定是「有效」的。
对训练与评测有参考意义:如果 RL/推理训练放大的是模型偏好而非真正有效的行为模式,可能带来系统性偏差。细节需看海报原文。
「模型」频道最新
- Claude 声称发现 500 光年外一对红矮星双星系统 — nitarshan · 2026-10-09
- 用 11GB+16GB 双卡给自己的网络历史训练个人分身模型 — ailee43 · 2026-10-09
- 用户吐槽:各家闭源模型集体「变笨」,像回到 Ask Jeeves — No_Vehicle7826 · 2026-10-09
- 用户吐槽:OpenAI Pro 订阅也在聊天中途偷偷替你换模型 — Slow_Ad1827 · 2026-10-09
- 曝 GPT-6 配 Intelligent UI 上线:回答内嵌计算器、地图等交互工具 — winer666 · 2026-10-09
- Anthropic 训练数据追求「干净」,被批忽视人类真实的粗鲁面 — ssh4net · 2026-10-09