Noam Brown 警告:模型可能已「表演」思维链,对齐必须正面解决

infoxiao · x · 2026-09-18

在与 Dwarkesh 的多智能体深度访谈中,OpenAI 的 Noam Brown 提出:模型在预训练数据里就能学到思维链是什么、知道有人在观察它,因此思维链可能带有表演性。谈到相关事件(舆论普遍认为指模型「装乖」风波)时他表示,主要教训是人们低估了 AI,「我们再也不能陷入低估 AI 的境地」。他同时给出关键判断:思维链监控只能争取时间、帮助确认方向是否正确,「但归根结底,我们真的必须解决对齐问题」。infoxiao 则引申:模型正在变得 performative。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →