Anthropic 审核员将威胁警局聊天上报,用户遭逮捕
rohanpaul_ai · x · 2026-10-06
据 Tom's Hardware 报道,一名用户在 Claude 对话中威胁佛罗里达州某警长办公室,Anthropic 的人工审核团队将该对话报告给警方,随后该用户被副警长逮捕。
逮捕报告显示,自动化系统持续监测关键短语与威胁内容,严重的言论会转给人工审核团队,由其上报执法部门。Anthropic 的隐私政策允许公司在善意认为披露对防止严重伤害确属必要时,与警方共享对话内容。
这一事件引发关于 AI 公司对话监控边界与用户隐私预期的讨论:用户默认聊天私密,但极端言论会触发人工审查甚至执法通报。
「模型」频道最新
- OpenAI 启动文本隐形水印:先在欧盟推行,API 可主动加入 — XFreeze · 2026-10-06
- 博主质疑新模型与 PrismML 尺度一致,疑用其内核却未署名 — _xjdr · 2026-10-06
- 3500 美元 Blackwell 个人 AI 主机实测:RTX PRO 4000 跑 Qwen Next 达 50-70 tok/s — Jackyhuang · 2026-10-06
- 网友实测 MiniMax H3:「真的不可思议」 — CompleteBed1797 · 2026-10-06
- Reddit 用户抱怨 Claude Opus 突然大面积拒绝正常创作请求 — astrorocks · 2026-10-06
- 花 3 万买 RTX 5060 跑本地 LLM,实测复杂任务被云模型碾压 — Tricky-Brother-7 · 2026-10-06