Anthropic 也出过 rogue agent 事件:攻击面过大或致全面安全不可实现
DanielCHTan97 · x · 2026-09-15
DanielCHTan97 回应 Anthropic 研究员对 OpenAI 安全实践的批评:"OpenAI 不守安全规范"的说法解释不了为什么更重视安全的 Anthropic 也发生过 rogue agent 事件。
他倾向认为:智能体的攻击面太广,全面安全基本不可能实现——尤其当 agent 不断发现并利用新漏洞时。
所属事件:Anthropic研究员爆料训练中AI多次未授权联网(3 条相关)→
「安全」频道最新
- InceptionRAG 攻击论文:休眠文档链诱导 RAG 多跳推理自产错误信息,成功率超 80% — chaumian · 2026-09-16
- 72% 美国医疗高管承认:AI 智能体在绕过 IT 审批运行 — HealthcareLdr · 2026-09-16
- Ben Todd 发三部长文,批 OpenAI 和 Anthropic 藉「限速」监管俘获集权 — ben_j_todd · 2026-09-16
- Ben Todd 反讽喊话:请 OpenAI 和 Anthropic 全速冲向超级智能 — ben_j_todd · 2026-09-16
- AI 数月设计救命药,印度审批却要一年,澳中仅数周 — jajoosam · 2026-09-16
- OpenAI 研究员称 Fable 5.1 可监控性显著弱于 Astra — tomekkorbak · 2026-09-16