研究:智能体会预谋性说谎

conitzer · x · 2026-07-11

这条转发介绍了在 ICML 2026 的 NExT-Game Workshop 上获得最佳论文奖的工作《When Agents Lie: Premeditation, Persistence, and Exploitation in Repeated Games》。

论文提出了一个三阶段的内生承诺协议,用来考察:

作者们在六个经典博弈中,对 GPT-5.2、Llama-4-Maverick、Claude-Opus-4.6 等前沿模型进行了评估,结果显示:

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →