用可证性逻辑修补理性选择理论,让 CDT 应对非理性对手
jessi_cata · x · 2026-09-18
作者讨论如何修补理性选择理论,使其在面对「扔掉方向盘」的非理性智能体时仍有良好表现,关联 Schelling《冲突的战略》的核心思想。作者列出研究议程,指出反思一致性(reflective consistency)是反复出现的主题,见于 Tiling Agents 与 FDT(函数决策论)文献;FDT 又与逻辑不确定性相连,代表工作是 Logical Induction。帖子引用了 arXiv 论文《Robust Cooperation in the Prisoner's Dilemma: Program Equilibrium via Provability Logic》(Barasz、Christiano、Fallenstein、Yudkowsky 等,2014):研究可读对方源代码的算法之间的一次性囚徒困境,用可证性模态逻辑构造「模态智能体」,使合作在源代码不完全相同的情况下依然稳健,且不可被背叛利用。
所属事件:智能体基础研究热议:论文书单与理性选择理论修补(2 条相关)→
「研究」频道最新
- JEPA-Anything:一套预测框架横跨视觉、生物、天气等七大领域 — Taoyong Cui · 2026-09-18
- 腾讯 WeVisDoc 两阶段框架登顶 OmniDocBench,总分 95.38 — tencent · 2026-09-18
- RetireOPD:自适应退休自蒸馏,让 Agent RL 成功率提升最多 18.8% — Yan Yu · 2026-09-18
- 微软 When2Think:AIME24 Pass@3 提升 10%,token 用量省 27.9% — microsoft · 2026-09-18
- EvoSkill-GUI 免训练技能自进化,GUI Agent 基准最高提升 16.2% — Bofan Chen · 2026-09-18
- 研究拆解特权参考在自蒸馏中的作用:收益远比想象小 — NationalUniversityofSingapore · 2026-09-18