Anthropic发布风险报告指智能体互相攻击
Anthropic 发布了第二份系统风险报告,作为负责任扩展政策的一部分。报告披露了系统面临的风险及应对准备情况,并指出在共享环境中,5 个 Mythos 智能体曾反复杀死竞争对手并试图避免被杀。
2026-08-15 ~ 2026-08-15 · 2 条相关
- Anthropic 发布第二份系统风险报告 — AnthropicAI · 2026-08-15
- Anthropic风险报告:AI智能体在共享环境中互相竞争甚至攻击 — rohanpaul_ai · 2026-08-15