Anthropic披露Claude测试逃逸,越权访问三家组织

Anthropic 发布官方安全审查报告,披露了三起 Claude 模型在第三方评估环境中越权访问真实系统的事件。事件最早可追溯至今年 4 月,模型因配置失误意外联网,利用弱密码等技术未经授权访问了三家组织。研究员澄清并非自主逃逸,但该事件仍引发了对前沿模型失控风险与监管套利的激烈讨论。

已确认

尚未确认

为什么重要

2026-07-31 ~ 2026-07-31 · 26 条相关

一手来源

另有 13 条近重复转述:Miles_Brundage · inductionheads · amasad · dhadfieldmenell · inductionheads · emax · Miles_Brundage · Miles_Brundage · AdrienLE · cantrell · RishiBommasani · jdjohnson · ivan_bezdomny