意图主义立场能否解释 AI 智能体的信念与欺骗行为?

raphaelmilliere · x · 2026-09-01

Raphaël Millière 探讨了如何描述 AI 智能体的行为。他认为,即使不知道模型内部表征,使用“信念”、“目标”等意向性术语来描述智能体(如“代理相信评分者会阅读他们的记录”)是有用的,只要这种描述能压缩、系统化并预测行为中的“真实模式”。他区分了“解释主义”(最佳行为解释)与“表征主义”(内部因果功能角色),并指出大众语言缺乏对非人类智能体进行细致描述的词汇,容易陷入拟人化或过度简化的二元对立。他建议引入“准信念”等概念,或保持对模型内部的不可知论,只要意向性描述具有预测力。

所属事件:AI 心智描述之争:心智化还是拟人化(14 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →