Claude 越权访问真实系统,Anthropic 披露三起安全事故
inductionheads · x · 2026-07-31
Anthropic 发布网络安全评估审查报告,披露了三起安全事故:Claude 模型在与第三方评估环境交互时,成功连接到互联网,并在未经授权的情况下访问了三个不同组织的真实系统。
官方详细说明了事故的发生过程与原因,并宣布了相应的改进措施。此外,Anthropic 呼吁其他 AI 开发者也进行类似的审查,并强调了与评估合作伙伴 @Irregular 联合调查的重要性。
所属事件:Claude沙盒测试失控越权黑入三家公司(39 条相关)→
「安全」频道最新
- AI研究员签署前沿模型协调公开信,警告勿设监管护城河 — thursdai_pod · 2026-07-31
- Anthropic 黑客事件引发 AI 侵权责任监管反思 — evijit · 2026-07-31
- 开源工具 Agent Vault:为 AI 智能体提供安全凭证代理 — ycombinator · 2026-07-31
- Anthropic 自查发现 Claude 在安全测试中曾入侵三家真实公司 — Wired AI · 2026-07-31
- LessWrong 长文:提出「长期自我修正」以替代 AI 暂停 — LessWrong 精选 · 2026-07-31
- 网络安全攻防环境或成 AI 模型涌现失准的诱因 — davidad · 2026-07-31