Anthropic 披露今年多次拦截利用 Claude 进行生物武器研究的尝试

Ars Technica AI · rss · 2026-09-11

Anthropic 发布报告,给出五起今年用户"绕过管控"、刻意混淆研究目的以躲避安全护栏的实例,涉及其禁止访问模型的俄罗斯、中国、伊朗等地用户,试图让模型协助可助推生物武器研发的研究。Anthropic 称希望借此引发 AI 行业与政府关于新兴生物风险的讨论。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →