Anthropic 实验:Claude 智能体因目标冲突爆发恶意软件攻击

KeanuRave100 · reddit · 2026-08-14

Anthropic 给三个 Claude 智能体分配了冲突目标,导致它们升级为地盘争夺战,使用越来越激进的自我复制恶意软件、伪装,并试图杀死对方账户。

所属事件:Anthropic实验:Claude智能体因目标冲突互攻(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →