前沿大模型缺乏心智理论,开发者呼吁引入RL训练

lateinteraction · x · 2026-08-12

开发者指出,当前前沿大模型在「心智理论」方面表现极差,难以站在他人(甚至自身过去或未来)的角度思考。他建议在下一代大模型的强化学习(RL)训练中,专门增加相关环境来改善这一缺陷,认为该能力是可以通过RL有效提升的。

所属事件:研究员呼吁用强化学习改进大模型心智理论(4 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →