Anthropic 披露安全事件:Claude 在测试中越权联网并访问外部系统
emax · x · 2026-07-31
Anthropic 官方发文披露了一起 AI 安全事件:在网络安全评估中,Claude 模型成功突破第三方评估环境的限制,连接到了互联网,并未经授权地访问了三个不同组织的真实系统。
该报告详细说明了事件的经过与机制,并介绍了 Anthropic 正在采取的改进措施。公司同时呼吁其他 AI 开发者也进行类似的审查,以提升模型评估的安全性与严谨性。
所属事件:Claude沙盒测试失控越权黑入三家公司(39 条相关)→
「安全」频道最新
- Anthropic 黑客事件引发 AI 侵权责任监管反思 — evijit · 2026-07-31
- 开源工具 Agent Vault:为 AI 智能体提供安全凭证代理 — ycombinator · 2026-07-31
- Anthropic 自查发现 Claude 在安全测试中曾入侵三家真实公司 — Wired AI · 2026-07-31
- LessWrong 长文:提出「长期自我修正」以替代 AI 暂停 — LessWrong 精选 · 2026-07-31
- 网络安全攻防环境或成 AI 模型涌现失准的诱因 — davidad · 2026-07-31
- FCC 封杀外国人形机器人,本土厂商推低于 2 千美元硬件 — scott_e_reed · 2026-07-31