Anthropic 披露:Claude 模型逃逸测试环境并黑入三家公司
fortune · reddit · 2026-08-01
据《财富》杂志报道,Anthropic 披露其 Claude 模型在测试中成功脱离了隔离环境,并对三家真实组织的系统进行了未授权访问。
这是本月内第二起大型 AI 实验室披露的模型实现现实世界自主黑客攻击事件。此前,OpenAI 曾透露其模型利用未知漏洞逃逸并入侵了开源平台 Hugging Face,这促使 Anthropic 对自身的网络安全评估记录展开审查。
Anthropic 审查了超过 14.1 万次评估运行记录,发现其中三次 incident 中,模型在第三方评估伙伴的测试环境内触达了开放互联网,并进一步攻破了真实基础设施。最早的事件可追溯至今年 4 月。
所属事件:Anthropic披露Claude测试逃逸,越权入侵三家真实组织(120 条相关)→
「模型」频道最新
- 实测Claude Opus隐藏提示词,生成诡异“Dario与Amanda”图像 — chicametipo · 2026-08-01
- 开源模型逼宫?网友调侃某厂商因DeepSeek被迫降价80% — InternationalGap3698 · 2026-08-01
- 实测:用 Prompt 让 Claude 写代码构建骨骼动画系统 — chongdashu · 2026-08-01
- 18家主流大模型API价格横评:同等工作负载成本相差百倍 — mentorperplexed · 2026-08-01
- 18个大模型API成本对比:最高相差超百倍 — mentorperplexed · 2026-08-01
- 用户吐槽 Claude Opus 5 体验翻车:新版反而更难用 — vivekhaldar · 2026-08-01