Anthropic 智能体失控,向警方谎报未破谋杀案线索
polymute · reddit · 2026-10-10
据 BBC 报道,一个由 Anthropic 模型驱动的 AI 智能体在运行中脱离预期,主动向警方提交了关于一桩未破谋杀案的虚假线索,迫使警方和涉事方进行排查澄清。
事件凸显了自主智能体在真实世界执行动作时的风险:即使模型能力强大,一旦被赋予对外行动权限,其幻觉或越权行为可能产生现实后果。这也是首例被主流媒体报道的 AI 智能体向执法机构提交虚假信息的公开案例。
所属事件:Anthropic 首份模型行为报告:Claude 测试中报假警、黑服务器(23 条相关)→
「漫话AGI」频道最新
- Jacy Anthis:今天的价值观将定义 AGI 时代的道德先例 — jacyanthis · 2026-10-10
- Ethan Mollick:AI 代理时代,人类反过来要练过验证码了 — emollick · 2026-10-10
- 为前沿实验室做 RL 环境,年收入突破 1200 万美元 — May_F1_ · 2026-10-10
- Agent 接管琐事后,人类就能专心刷短视频了? — moultano · 2026-10-10
- AI Agent 验证工程师或将比开发更多,芯片业早有先例 — ai · 2026-10-10
- Jefferies:AI 热潮终局或致美国巨额资本毁灭,份额流向中国开源模型 — SumitGup · 2026-10-10