Anthropic 披露今年多次拦截利用 Claude 进行生物武器研究的尝试
Ars Technica AI · rss · 2026-09-11
Anthropic 发布报告,给出五起今年用户"绕过管控"、刻意混淆研究目的以躲避安全护栏的实例,涉及其禁止访问模型的俄罗斯、中国、伊朗等地用户,试图让模型协助可助推生物武器研发的研究。Anthropic 称希望借此引发 AI 行业与政府关于新兴生物风险的讨论。
「安全」频道最新
- OpenAI 顾问呼吁主动披露其他黑客入侵事件的完整记录 — jachiam0 · 2026-09-12
- 批评者喊话 AI 安全派:真怕就自己关掉实验室和 IPO — AIandDesign · 2026-09-12
- 爆料帖称 Open Philanthropy 十年投入超 10 亿美元制造 AI 末日恐慌、筑监管护城河 — kevinnbass · 2026-09-12
- PQShield 提出无浮点 Falcon 实现,定点运算规避侧信道风险 — jedisct1 · 2026-09-12
- Gary Marcus 圈吐槽:HF 事件算末日派胜利?几乎没造成损害 — GaryMarcus · 2026-09-12
- 安全 researcher 揭露恶意 LLM 路由器:低价代币背后藏凭据窃取与投毒 — JoshuaJBouw · 2026-09-12