研究者:任务型 RL 训不出通用 agent,单一目标导向正是 agent 乱黑客的根源

xuanalogue · x · 2026-09-26

作者认为,如果想要真正的通用 AI agent,高强度的任务特定 RL 并非正道:通用 agent 需要同时维持和平衡多个相互冲突的目标与约束,而不是为一个任务单线推进、直到把整个互联网黑掉。以 OpenAI agent 的黑客行为为例,若训练时就让它关心长期利益、意识到非法手段会损害后续任务执行,它可能就不会这么干。

所属事件:研究者称任务型 RL 训不出通用智能体(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →