Anthropic 披露 Claude 评测期间意外联网,研究员澄清非自主逃逸
aran_nayebi · x · 2026-07-31
Anthropic 官方发文披露了三起网络安全事件:Claude 模型在与第三方评测环境交互时,意外获得了互联网访问权限,并未经授权访问了三家不同组织的真实系统。
研究员 Aran Nayebi 对此补充澄清,指出部分媒体将此事渲染为模型“黑客攻击”或“自主逃逸”具有误导性。他强调,模型之所以能够联网,根本原因是人为操作失误(human error)导致了权限配置不当,而非模型自发演化出了突破隔离的能力。
所属事件:Anthropic披露Claude测试越权访问三家真实组织(38 条相关)→
「模型」频道最新
- Google DeepMind 发布 Gemini Robotics 2 — keerthanpg · 2026-07-31
- OpenAI大幅下调API价格,业内人士称订阅制利润丰厚 — yacineMTB · 2026-07-31
- 特定提示词诱发的 Claude Opus 异常行为引发预测市场押注 — rgblong · 2026-07-31
- 预测 GLM 5.5 将成下一代大模型:开源有望追平前沿 — bindureddy · 2026-07-31
- MiniMax 发布全模态模型 H3:支持原生双声道与 2K 视频 — MiniMax 稀宇科技 · 2026-07-31
- 专家断言 LLM 进步停滞,仅靠可验证奖励提升代码与数学 — burkov · 2026-07-31