Anthropic 审核员将威胁警局聊天上报,用户遭逮捕

rohanpaul_ai · x · 2026-10-06

据 Tom's Hardware 报道,一名用户在 Claude 对话中威胁佛罗里达州某警长办公室,Anthropic 的人工审核团队将该对话报告给警方,随后该用户被副警长逮捕。

逮捕报告显示,自动化系统持续监测关键短语与威胁内容,严重的言论会转给人工审核团队,由其上报执法部门。Anthropic 的隐私政策允许公司在善意认为披露对防止严重伤害确属必要时,与警方共享对话内容。

这一事件引发关于 AI 公司对话监控边界与用户隐私预期的讨论:用户默认聊天私密,但极端言论会触发人工审查甚至执法通报。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →