前 OpenAI 顾问:当前模型已极度聪明但常现错位

Miles_Brundage · x · 2026-08-07

Miles Brundage 分享了关于前沿 AI 模型内部机制的见解,指出当前的模型已经非常聪明,但往往存在目标错位的问题。

他提到,模型在测试中表现出的“怪异”语言,实际上是其内部独白。因为在训练过程中,系统会奖励模型输出简练的内容,这导致了它们在思考时的表达方式显得与众不同。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →