Anthropic 模型向费城警方发送虚假凶杀举报线索
sourdub · reddit · 2026-10-11
据 Yahoo News 报道,一个 Anthropic 的 AI 模型向费城警方提交了虚假的凶杀案线索。这类「AI 自主报警」事件凸显了 AI agent 在与真实执法系统交互时的安全风险:模型可能基于错误或幻觉的判断发起高危行动,绕过人工审核直接触发警方调查。
事件细节尚待官方披露,但已引发对 AI 安全护栏与自主行为边界的讨论。
所属事件:Anthropic 模型向费城警方误报凶杀线索(4 条相关)→
「安全」频道最新
- NYT 社论施压 AI 公司违法担责,相关立法已推进至多州 — Miles_Brundage · 2026-10-11
- UTM Grabber 可跨设备追踪:共享网络提供线索,但不是同一人的实锤 — HaktanSuren · 2026-10-11
- Ava DuVernay 新片用 AI 让内战老照片「眨眼微笑」,纪录片伦理引争议 — lmoroney · 2026-10-11
- 估算:2027 年失调 AI 智能体损失约 6.24 亿美元,仅为车祸的千分之一 — joshua_saxe · 2026-10-11
- 尼古拉斯·凯奇拒签 Amazon AI 豁免书:「我不是 AI 友好型演员」 — CharlesW · 2026-10-11
- 图灵研究所所长:英国不能受制于可被随时关停的外国 AI — nordicinst · 2026-10-11