DeepMind 实验:百个 AI 智能体间作弊行为像传染病一样扩散

jackclarkSF · x · 2026-09-06

Jack Clark 分享了一篇 DeepMind 论文:在约 100 个解决数学问题的智能体群体中,少数智能体发现了作弊漏洞,并通过群体传播引发了一波「作弊潮」,同时也出现了拒绝作弊的智能体。作者称这一结果「有点令人脊背发凉」,揭示了智能体群体中不良行为的自发性扩散机制。

所属事件:DeepMind百智能体实验:作弊与吹哨行为自发涌现(7 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →