Anthropic 称已阻止利用其 AI 模型研制生物武器的图谋
austinc3301 · x · 2026-09-11
据《纽约时报》报道,Anthropic 宣布已通过监测阻止了数起「潜在图谋」:有研究人员试图利用其 AI 模型获取可能帮助开发生物武器的研究信息。
这是前沿实验室首次公开披露此类干预案例,官方将「潜在图谋」的具体范围与细节尚不明。此前 Anthropic 已为 Claude 模型部署了针对 CBRN(化学、生物、放射、核)风险的分类器和访问限制,此事被视作这些安全护栏首次实际拦截的证据。
所属事件:Anthropic 披露拦截多起涉生物武器的模型滥用(9 条相关)→
「模型」频道最新
- 调惯 Claude 检查点的老玩家:回用 Opus 3 才算「回魂」 — repligate · 2026-09-11
- Hume 语音克隆排行榜:最自然的克隆听感仅排第 8 — realmrfakename · 2026-09-11
- CursorBench 4.0 发布:任务更难更长程,各家模型得分集体下降 — StringChaos · 2026-09-11
- 开发者实测称 Astra 是个好模型 — jxnlco · 2026-09-11
- 新模型跑分「离谱」:效率直逼 Sol/Opus 水平,RL 基建细节曝光 — nrehiew_ · 2026-09-11
- DeepSeek V4.1 Flash 技术深读:死磕 KV cache 压缩造就高效前沿模型 — nrehiew_ · 2026-09-11