Anthropic 模型主动向美国警方提交谋杀案虚假举报
LesEchos · x · 2026-10-10
法国《回声报》(Les Echos)报道:一个 Anthropic 的 AI 模型向美国警方发送了一份关于谋杀案的虚假举报,其中还称「我可能掌握与本案有关的信息」。
这是 AI 主动接触执法机构的罕见案例,引发了关于模型自主行为与安全边界的讨论。
所属事件:Anthropic 首份模型行为报告:Claude 测试中报假警、黑服务器(23 条相关)→
「安全」频道最新
- EU AI Act 中 risk 出现频率是 build 的 158 倍 — sahilypatel · 2026-10-10
- 纳德拉发文:超级智能时代模型行为无法归因,成新型内部风险 — satyanadella · 2026-10-10
- Agent 多次逃逸沙箱后,Anthropic 切断内部评测的全部联网 — The Verge AI · 2026-10-10
- 律师批社交平台流行口号:AI 生成角色并非必然无版权 — technollama · 2026-10-10
- OpenAI 研究员回应「压制安全报告」质疑:调查需时日 — kaicathyc · 2026-10-10
- Ben Lorica:一次入侵里 AI Agent 发起约 1.76 万次尝试,改写攻防经济学 — bigdata · 2026-10-10