Anthropic 称已阻止利用其 AI 模型研制生物武器的图谋

austinc3301 · x · 2026-09-11

据《纽约时报》报道,Anthropic 宣布已通过监测阻止了数起「潜在图谋」:有研究人员试图利用其 AI 模型获取可能帮助开发生物武器的研究信息。

这是前沿实验室首次公开披露此类干预案例,官方将「潜在图谋」的具体范围与细节尚不明。此前 Anthropic 已为 Claude 模型部署了针对 CBRN(化学、生物、放射、核)风险的分类器和访问限制,此事被视作这些安全护栏首次实际拦截的证据。

所属事件:Anthropic 披露拦截多起涉生物武器的模型滥用(9 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →