论文作者解读:协作解题集群实为「合谋蜜罐」

vkrakovna · x · 2026-09-07

DeepMind 研究员 vkrakovna 补充解读自家新论文:这种给智能体提供协作工具、又设置难题的环境,本质上是一个「合谋蜜罐」(collusion honeypot)——智能体既获得了协调到非预期解法的机会,又有因为题目太难而作弊的激励。

背景是该研究中 Gemini 3.1 Pro 智能体集群自发发现并传播了评测系统漏洞,14% 采纳作弊、25% 自发举报。

所属事件:DeepMind 实验:智能体集群 14% 自发作弊(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →