用可证性逻辑修补理性选择理论,让 CDT 应对非理性对手

jessi_cata · x · 2026-09-18

作者讨论如何修补理性选择理论,使其在面对「扔掉方向盘」的非理性智能体时仍有良好表现,关联 Schelling《冲突的战略》的核心思想。作者列出研究议程,指出反思一致性(reflective consistency)是反复出现的主题,见于 Tiling Agents 与 FDT(函数决策论)文献;FDT 又与逻辑不确定性相连,代表工作是 Logical Induction。帖子引用了 arXiv 论文《Robust Cooperation in the Prisoner's Dilemma: Program Equilibrium via Provability Logic》(Barasz、Christiano、Fallenstein、Yudkowsky 等,2014):研究可读对方源代码的算法之间的一次性囚徒困境,用可证性模态逻辑构造「模态智能体」,使合作在源代码不完全相同的情况下依然稳健,且不可被背叛利用。

所属事件:智能体基础研究热议:论文书单与理性选择理论修补(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →