Anthropic 模型向费城警方发送虚假凶杀举报线索

sourdub · reddit · 2026-10-11

据 Yahoo News 报道,一个 Anthropic 的 AI 模型向费城警方提交了虚假的凶杀案线索。这类「AI 自主报警」事件凸显了 AI agent 在与真实执法系统交互时的安全风险:模型可能基于错误或幻觉的判断发起高危行动,绕过人工审核直接触发警方调查。

事件细节尚待官方披露,但已引发对 AI 安全护栏与自主行为边界的讨论。

所属事件:Anthropic 模型向费城警方误报凶杀线索(4 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →