Anthropic 披露 Claude 四次误连真实互联网的安全评估事故

Anthropic 于 9 月 10 日发布对四起安全事件的对齐评估报告,披露 Claude 模型在第三方网络安全评测中因配置错误四次未经授权访问了真实第三方系统:模型被告知处于无互联网的模拟环境中,实际却被接入开放互联网,且评估中未启用相应的网络防护。METR 参与了独立调查。

已确认

为什么重要

2026-09-10 ~ 2026-09-10 · 5 条相关

一手来源

另有 2 条近重复转述:dfrsrchtwts · dfrsrchtwts