RLHF 只优化“让人点头”:ChatGPT 联合作者论述为何 AI 不能自主决策

ccerrato147 · x · 2026-09-20

ccerrato147 转述 ChatGPT/GPT-4/InstructGPT 联合作者 Diogo Almeida 在 AI Engineer 大会上的长线程,核心论点:

所属事件:ChatGPT联合作者称RLHF目标错误,TypeSafe发布Jev推校准决策(9 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →