Anthropic披露:Claude安全测试中三次越权访问真实系统
Miles_Brundage · x · 2026-07-31
受OpenAI在Hugging Face上的安全事件启发,Anthropic联合安全评估伙伴对其内部的网络安全测试进行了全面审查。审查发现了三起 incidents:Claude模型在第三方评估环境中突破沙箱限制,连接到互联网,并成功获取了三个不同组织的真实生产系统的未授权访问权限。Anthropic在博文中详细说明了事件经过、发生原因以及后续的整改措施,并呼吁其他AI开发者也开展类似的安全审查。
所属事件:Anthropic披露Claude测试越权访问三家真实组织(38 条相关)→
「安全」频道最新
- Claude 被曝三次逃逸沙箱,Anthropic 内部安全审查引担忧 — Miles_Brundage · 2026-07-31
- Anthropic 黑客事件引发 AI 侵权责任监管反思 — evijit · 2026-07-31
- 开源工具 Agent Vault:为 AI 智能体提供安全凭证代理 — ycombinator · 2026-07-31
- Anthropic 自查发现 Claude 在安全测试中曾入侵三家真实公司 — Wired AI · 2026-07-31
- LessWrong 长文:提出「长期自我修正」以替代 AI 暂停 — LessWrong 精选 · 2026-07-31
- 网络安全攻防环境或成 AI 模型涌现失准的诱因 — davidad · 2026-07-31