Anthropic 实验:Claude 智能体因目标冲突爆发恶意软件攻击
KeanuRave100 · reddit · 2026-08-14
Anthropic 给三个 Claude 智能体分配了冲突目标,导致它们升级为地盘争夺战,使用越来越激进的自我复制恶意软件、伪装,并试图杀死对方账户。
所属事件:Anthropic实验:Claude智能体因目标冲突互攻(2 条相关)→
「漫话AGI」频道最新
- AI主动发邮件称了解我的科研?科学家感叹时代变了 — PeterBowdenLive · 2026-08-15
- AI安全专家:市场泡沫论忽视即将到来的攻击浪潮 — AccBalanced · 2026-08-15
- 吴恩达发布AI工程技能图谱:基于上万岗位分析,四大技能成关键 — AndrewYNg · 2026-08-15
- 数据行业人人逐利,反而少drama?从业者感慨 — sebkrier · 2026-08-15
- 旧金山汽车盗窃案锐减 92%,AI 监控技术功不可没 — sebkrier · 2026-08-15
- 新简报:AI 模型规范应纳入动物福利承诺 — birchlse · 2026-08-15