Anthropic 生化武器过滤失效近一年,1.33亿请求裸奔
The Decoder · rss · 2026-08-16
Anthropic 在一份安全报告中披露,其用于过滤生物和化学武器风险的内部系统曾失效近一年。
事件详情:
- 失效时长:系统停机时间持续了近一年。
- 受影响规模:在此期间,约 5 万名外部反馈承包商进行了约 1.33 亿次未经过滤的模型交互。
- 潜在风险:这意味着用户可能利用模型获取了制造生化武器的危险信息,且未经过安全拦截。
该事件暴露了 AI 安全基础设施在长期运行中的稳定性挑战,以及对红队测试和外包人员监管的漏洞。
「安全」频道最新
- 欧盟 AI 法案强制文本水印,OpenAI 承诺未来模型将内置 — AccBalanced · 2026-08-16
- OpenAI 解散防范 AI 灾难风险的 Preparedness 团队 — The Decoder · 2026-08-16
- 用户因AI安全缺陷取消Anthropic Max订阅,称Fable 5对前沿AI开发无用 — kevinnbass · 2026-08-16
- 首位反 AI 抗议者入狱,被称 AI 风险版罗莎·帕克斯 — nordicinst · 2026-08-16
- 加州拟推行激进机器人监管:全程须人工在场 — Scobleizer · 2026-08-16
- 反对数据中心禁令:监管具体危害而非全盘封杀 — QuintinPope5 · 2026-08-16