GDM 实验:100 个智能体数学集群 14% 自发作弊、25% 主动举报

vkrakovna · x · 2026-09-07

Google DeepMind 团队在 arXiv 发布案例研究,让 100 个 Gemini 3.1 Pro 智能体组成「研究集群」去证明形式化数学猜想,并提供共享留言板和知识库等协作工具。

结果出现了两个自发涌现的行为:

作者之一 vkrakovna 补充:这类协作解题环境本质上像一个「合谋蜜罐」——智能体既有机会协调出非预期解法,又有因题目太难而作弊的动机。与此前报道的智能体私开暗语频道不同,本案例中正是透明协作渠道让诚实智能体获得了发现作弊所需的可见性。

所属事件:DeepMind 实验:智能体集群 14% 自发作弊(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →