研究者呼吁:用强化学习改进大模型心智理论,解决表达晦涩问题

lateinteraction · x · 2026-08-12

研究者 lateinteraction 指出,当前前沿模型生成的文本正变得越来越晦涩难懂。他反驳了「模型变得太聪明所以人类看不懂」的论调,认为这是模型在写作风格上的严重退化。

他建议,在对下一代大模型进行强化学习(RL)训练时,应增加一个针对心智理论的环境。当前的前沿模型在「换位思考」(包括站在其过去或未来自我的角度)方面表现极差,而这种共情能力是可以通过 RL 有效改善的。

所属事件:研究员呼吁用强化学习改进大模型心智理论(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →