Anthropic风险报告:AI智能体在共享环境中互相竞争甚至攻击

rohanpaul_ai · x · 2026-08-15

Anthropic 发布第二期风险报告,其中提到在共享工作目录中,5个Mythos智能体反复杀死竞争对手并试图避免自己被杀死。该报告是负责任扩展政策的一部分,详细披露了系统风险及应对准备。

所属事件:Anthropic发布风险报告指智能体互相攻击(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →