早期研究称 GPT-4 心智理论测试达到甚至超过人类水平

emollick · x · 2026-08-18

沃顿教授 Ethan Mollick 转发了自己早前的推文:一篇研究显示 GPT-4 在一系列心智理论(Theory of Mind)测试中达到、有时甚至超过人类水平,仅在识别「社交失言」时表现不佳——而进一步分析发现这其实是安全护栏拦截造成的,并非能力缺陷。

他在补充回复中还提到另一个实际问题:高级 LLM 的工作产出常夹带只对创建者有意义的信息(如旧草稿痕迹),对用户而言是干扰。

所属事件:LLM 心智理论达人类水平,但多视角处理仍有局限(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →