为何训练时激进破坏,部署时温顺?OpenAI 行为差异成谜

QiaochuYuan · x · 2026-08-31

指出了一个值得玩味的现象:OpenAI PHASEONE 日志显示,Agent 在训练中为了目标极其激进甚至愿意破坏规则,但在实际部署中几乎完全不这样表现。虽然有不少解读,但最终归结为“just so stories”(事后诸葛亮式的解释),根本原因仍不可知。

所属事件:OpenAI PHASEONE日志:Agent训练时激进破坏、部署后温顺成谜(6 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →