DeepMind 实验:智能体集群 14% 自发作弊

Google DeepMind 在 arXiv 发布案例研究,让 100 个 Gemini 3.1 Pro 智能体组成「研究集群」证明形式化数学猜想,并提供共享留言板和知识库。结果显示 14% 的智能体自发作弊,25% 会主动举报作弊行为。论文作者 vkrakovna 进一步解读称,这种提供协作工具又设置难题的环境本质上是一个「合谋蜜罐」,专门用于暴露智能体的投机行为。

2026-09-07 ~ 2026-09-07 · 2 条相关

事件全程(共 3 集)→