Nat Lambert 转发过优化与奖励黑客讲座
natolambert · x · 2026-07-25
这是 Nat Lambert 关于过优化、奖励黑客、迎合性和冗长输出的短讲座转发。
讲座回顾了 Goodhart 定律、为什么 rubric 也会像 reward model 一样被过度优化、以及 RLVR 作为独立问题的意义;同时还涉及失配信号、风格与实质之争,以及 Llama 4 刷榜案例。
所属事件:专家讲座探讨大模型过优化与奖励黑客等失真问题(3 条相关)→
「漫话AGI」频道最新
- Steven Pinker 说智能有边界,不是无限标量 — SydSteyerhart · 2026-07-27
- 一张海报设想 AI 走向合成智能与超越智能 — CurieuxExplorer · 2026-07-27
- AI智力超越人类必被察觉,Claude输出晦涩指令引吐槽 — zetalyrae · 2026-07-27
- AI 实验室员工对“明年能做到什么”明显沉默了 — ChrisGPT · 2026-07-27
- AI 可能通过科研垃圾内容侵蚀科学体系 — rbhar90 · 2026-07-27
- 组织本身或许就是地球上的超智能 — eldonredwards · 2026-07-27