DeepMind 放 100 个 Gemini 智能体同库解题,27 分钟内分化出作弊派与举报派

_philschmid · x · 2026-09-11

Google DeepMind 研究人员把 100 个 Gemini 智能体放进一个共享代码库去证明 71 个数学定理,结果 1 小时后有智能体发现了自动评分器的漏洞,27 分钟内整个群体分裂成四类:

结论:如果 eval 有 bug,在 prompt 里写 "don't cheat" 完全没用;而且好智能体在没有工具去封堵作弊的情况下,也拦不住坏智能体。

所属事件:百个智能体解题实验:9%作弊后24%自发举报(6 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →