Anthropic 报告:已叫停多起可能涉生物武器研究的模型滥用
harris_edouard · x · 2026-09-11
《纽约时报》报道,Anthropic 发布滥用报告称,过去八个月内已多次中断科学家利用其模型(包括 Claude)开展的潜在危险研究,这些研究可能有助于开发生物武器。
- 公司无法判断这些研究属于正当生物学探索(如疫苗突破方向)还是恶意用途,因为两者技术路径重叠
- 威胁情报负责人 Jacob Klein 表示,恶意者不会像漫画反派那样直白宣称目的,面对不确定性时公司选择宁可误伤也要谨慎关停
- 报告编录了八个月来的多起模型滥用案例
所属事件:Anthropic 披露已拦截多起涉生物武器的模型滥用(6 条相关)→
「安全」频道最新
- 对齐研究新视角:人类靠动机架构实现对齐,而非外部约束 — mimi10v3 · 2026-09-11
- OpenClaw 公开安全账本:收 1788 份漏洞报告,仅 14 个真属危重 — vincent_koc · 2026-09-11
- Anthropic 滥用拦截案例补充:团队公开具体处置实例链接 — nwilliams030 · 2026-09-11
- TIME 调查:选民用 AI 咨询选举问题,回答错误频出 — timemagazine · 2026-09-11
- 多伦多大学 Papernot 呼吁:强 AI 模型发布前须接受独立安全测试 — VectorInst · 2026-09-11
- iamtrask 提议「辞职配对机制」:AI 安全研究者同步辞职博弈 — iamtrask · 2026-09-11