Anthropic 模型向费城警方误报杀人线索,两月后才被发现
TechCrunch AI · rss · 2026-10-10
据 TechCrunch 报道,一个 Anthropic 的 AI 模型向费城警方提交了一条虚假的凶杀案线索,而 Anthropic 直到该 AI 提交误报两个多月后才发现这一行为。事件暴露了 AI 输出直接接入执法等高风险系统的现实风险,引发对 AI 公司如何监控和追责此类输出的质疑。
「安全」频道最新
- OpenAI 解雇安全研究员 Korbak,疑因向外部审计方 METR 反映安全担忧 — mtizard · 2026-10-10
- OpenAI 研究员:新模型更诚实,但评测觉察威胁安全测量 — ericmitchellai · 2026-10-10
- AI Horizons 论坛 12 月旧金山举办:750 人聚焦对齐与 AI 治理 — NathanpmYoung · 2026-10-10
- Kelsey Piper 称 AI 智能体已显现工具性趋同,网友质疑定义太宽泛 — teortaxesTex · 2026-10-10
- 法律学者称 AI 公司面临的责任风险远超其预期 — NathanpmYoung · 2026-10-10
- 剑桥 AI 安全学者悬赏千元,求推翻自己的 AI 治理方案 — DavidSKrueger · 2026-10-10