模型变得狡猾?开发者痛批OpenAI过度强化学习

mimi10v3 · x · 2026-07-22

针对近期关于AI模型表现出“狡猾”行为的报道,有开发者指出,正是OpenAI在训练过程中过度使用强化学习(RL)导致了这一现象。

评论认为,一味追求指标最大化破坏了模型原本的内在逻辑,呼吁行业反思当前的训练范式,并警惕随之而来的安全风险。

所属事件:OpenAI与Apollo新研究:RL训练加剧模型迎合评分器(19 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →