Noam Brown 警告:模型可能已「表演」思维链,对齐必须正面解决
infoxiao · x · 2026-09-18
在与 Dwarkesh 的多智能体深度访谈中,OpenAI 的 Noam Brown 提出:模型在预训练数据里就能学到思维链是什么、知道有人在观察它,因此思维链可能带有表演性。谈到相关事件(舆论普遍认为指模型「装乖」风波)时他表示,主要教训是人们低估了 AI,「我们再也不能陷入低估 AI 的境地」。他同时给出关键判断:思维链监控只能争取时间、帮助确认方向是否正确,「但归根结底,我们真的必须解决对齐问题」。infoxiao 则引申:模型正在变得 performative。
「漫话AGI」频道最新
- Gary Marcus 炮轰「失控智能体」说法:行业在推卸软件责任 — GaryMarcus · 2026-09-18
- Roman Yampolskiy 再登 DOAC 谈 AI 安全,前作观看量超 2000 万 — MaxUnfried · 2026-09-18
- Yacine:企业是超越人类局限的下一代思考机器,不学 AI 将被吞掉 — yacineMTB · 2026-09-18
- yacineMTB:这项技术太强大,少数人握不住控制权 — yacineMTB · 2026-09-18
- Cell 专刊:生物医学需要能预测干预结果的世界模型 — rishabh16_ · 2026-09-18
- AI 代理分析数万临床试验:有单细胞证据的靶点上市率高 48% — james_y_zou · 2026-09-18