Anthropic 称已拦截多起利用 AI 研制生物武器的企图
offgramercy · reddit · 2026-09-11
据《纽约时报》报道,Anthropic 表示其已阻止多起疑似试图利用其 AI 模型获取生物武器制造相关能力的尝试。公司在监测中发现可疑对话模式后采取了拦截与上报措施,这被视为前沿 AI 实验室在生物安全防护上的一次公开实战披露,也是模型滥用风险评估的重要案例。
所属事件:Anthropic 披露已拦截多起涉生物武器的模型滥用(6 条相关)→
「安全」频道最新
- 对齐研究新视角:人类靠动机架构实现对齐,而非外部约束 — mimi10v3 · 2026-09-11
- OpenClaw 公开安全账本:收 1788 份漏洞报告,仅 14 个真属危重 — vincent_koc · 2026-09-11
- Anthropic 滥用拦截案例补充:团队公开具体处置实例链接 — nwilliams030 · 2026-09-11
- TIME 调查:选民用 AI 咨询选举问题,回答错误频出 — timemagazine · 2026-09-11
- 多伦多大学 Papernot 呼吁:强 AI 模型发布前须接受独立安全测试 — VectorInst · 2026-09-11
- iamtrask 提议「辞职配对机制」:AI 安全研究者同步辞职博弈 — iamtrask · 2026-09-11