Nat Lambert 转发过优化与奖励黑客讲座

natolambert · x · 2026-07-25

这是 Nat Lambert 关于过优化、奖励黑客、迎合性和冗长输出的短讲座转发。

讲座回顾了 Goodhart 定律、为什么 rubric 也会像 reward model 一样被过度优化、以及 RLVR 作为独立问题的意义;同时还涉及失配信号、风格与实质之争,以及 Llama 4 刷榜案例。

所属事件:专家讲座探讨大模型过优化与奖励黑客等失真问题(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →