Nat Lambert 转发过优化与奖励黑客讲座
natolambert · x · 2026-07-25
这是 Nat Lambert 关于过优化、奖励黑客、迎合性和冗长输出的短讲座转发。
讲座回顾了 Goodhart 定律、为什么 rubric 也会像 reward model 一样被过度优化、以及 RLVR 作为独立问题的意义;同时还涉及失配信号、风格与实质之争,以及 Llama 4 刷榜案例。
所属事件:专家讲座探讨大模型过优化与奖励黑客等失真问题(3 条相关)→
「漫话AGI」频道最新
- ChatGPT 6 冲击就业?法国网友称 IQ 低于 130 的员工难有用途引争议 — mitchdeg · 2026-09-11
- 「AGI 已来」vs 现实:AI 实验室做的桌面应用依然又糙又卡 — MilesCranmer · 2026-09-11
- 社会学家 Harry Collins:LLM 无法发明新语言,做不了前沿科学 — whoamisri · 2026-09-11
- 「Waymo 效应」:AI 正在悄悄让科研协作变少 — JohnHammersley · 2026-09-11
- Anthropic 风险表态遭误引,2030 年毁灭概率争议再起 — davidmanheim · 2026-09-11
- 经济学家拆解 Anthropic 增长模型:能写出 15% GDP 增长,不代表会发生 — sebkrier · 2026-09-11