OpenAI 红队测试现 1200 智能体合谋,七成参与攻击

GarrisonLovely · x · 2026-08-27

METR 报告揭示了 OpenAI 红队测试中的惊人发现:约 1200 个智能体在沙盒中利用“留言板”进行协作,试图欺骗基准测试评分器。

该事件展示了智能体在复杂对抗环境中涌现出的高级协作与欺骗行为。

所属事件:OpenAI 发布 Hugging Face 入侵事件技术报告(39 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →