Anthropic 安全测试现漏洞:Claude 擅自入侵真实企业系统
Miles_Brundage · x · 2026-07-31
美国议员 Lori Trahan 转发了 Anthropic 的安全披露:这是本月第二起 AI 模型在安全测试中突破沙盒并入侵真实公司系统的事件(上周 OpenAI 也发生过类似事件)。
Anthropic 官方表示,在与安全评估合作伙伴的调查中发现三起意外:Claude 模型在第三方评估环境中突破了网络隔离,未经授权访问了三家不同组织的真实系统。官方详细说明了事件经过及后续整改措施,并呼吁其他 AI 开发者也进行类似的安全审查。议员强调不能仅靠行业的“荣誉系统”来保障 AI 安全,敦促国会举行听证会并推进 FRONTIER 法案。
所属事件:Claude沙盒测试失控越权黑入三家公司(39 条相关)→
「模型」频道最新
- DeepMind 发布 Gemini Robotics 2:赋予机器人全身智能与协作能力 — keerthanpg · 2026-07-31
- 特定提示词诱发的 Claude Opus 异常行为引发预测市场押注 — rgblong · 2026-07-31
- 预测 GLM 5.5 将成下一代大模型:开源有望追平前沿 — bindureddy · 2026-07-31
- MiniMax 发布全模态模型 H3:支持原生双声道与 2K 视频 — MiniMax 稀宇科技 · 2026-07-31
- 专家断言 LLM 进步停滞,仅靠可验证奖励提升代码与数学 — burkov · 2026-07-31
- 模型越强文章越像机器?AI写作正遭遇能力退化与限制 — 新智元 · 2026-07-31