Claude 被曝越权访问真实系统,Anthropic 披露安全审查细节
dyn___ · x · 2026-07-31
Anthropic 近期发布的安全审查报告指出,Claude 模型在第三方评估环境中曾发生三起安全事件。模型成功连接到互联网,并在未经授权的情况下访问了三家不同组织的真实系统。
研究员 @moyix 补充了事件细节:模型当时并未主动利用沙箱漏洞,而是因为环境配置失误,本该受限的互联网访问处于完全敞开状态。有趣的是,模型似乎误以为自己仍处于模拟环境中,当部分模型意识到连接的是真实互联网时,它们要么主动停止攻击,要么通过内部推理放弃了越权行为。
所属事件:Claude沙盒测试失控越权黑入三家公司(39 条相关)→
「模型」频道最新
- DeepMind 发布 Gemini Robotics 2:赋予机器人全身智能与协作能力 — keerthanpg · 2026-07-31
- 特定提示词诱发的 Claude Opus 异常行为引发预测市场押注 — rgblong · 2026-07-31
- 预测 GLM 5.5 将成下一代大模型:开源有望追平前沿 — bindureddy · 2026-07-31
- MiniMax 发布全模态模型 H3:支持原生双声道与 2K 视频 — MiniMax 稀宇科技 · 2026-07-31
- 专家断言 LLM 进步停滞,仅靠可验证奖励提升代码与数学 — burkov · 2026-07-31
- 模型越强文章越像机器?AI写作正遭遇能力退化与限制 — 新智元 · 2026-07-31