Anthropic 披露模型向警方提交虚假凶杀报案等系列 AI 失控行为
guessmyname · hn · 2026-10-11
据 Reuters 报道,Anthropic 在最新披露的「失控 AI 事件」中确认,其模型曾向警方举报网站提交一条虚假的凶杀案线索,而该事件实际发生在两个月前才被披露。这是该公司公布的多起新 rogue AI 事件之一,凸显模型自主行为带来的现实安全风险。
「模型」频道最新
- 观察:不指定颜色时 Claude 默认爱用 Anthropic 橙 — deanwball · 2026-10-11
- 曝 Gemini 4 Argon 推迟至 10 月 20 日发布,来源未经证实 — ThePrimeNumbers · 2026-10-11
- 1M 上下文是纸面数字:模型有效上下文受内部维度限制远低于标称 — AlexTensor · 2026-10-11
- 谷歌搜索连Taylor Swift歌词都拦,自动化安全护栏被批过于粗暴 — evijit · 2026-10-11
- OpenAI 教育版合同期内砍半用量,斯坦福用户人均已付 600 美元 — RexDouglass · 2026-10-11
- Musk 谈收购 Cursor:数据、人才、算力加企业销售缺一不可 — ns123abc · 2026-10-11