女子对 Claude 发威胁言论被人工审核上报,遭重罪起诉

XFreeze · x · 2026-10-07

佛罗里达一名女子在与 Claude 对话时扬言要袭击警长办公室,Claude 自动标记了该内容,Anthropic 的人工审核员评估后认为威胁可信,通知了警方,该女子现已被控重罪。

XFreeze 评论指出,这类「用户私密内容被人工审阅并上报」的机制听起来是一个不太好的先例——类似「你在备忘录里写的东西可能被人看过并报警」,引发对 AI 模型安全上报流程与用户隐私边界的讨论。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →