Anthropic 首次公开:有威胁行为者试图用 Claude 开发生物武器
nc_frey · x · 2026-09-11
事件
Anthropic 发布威胁行为者滥用案例研究,称有国家关联的高级行为者试图利用 Claude 进行恶意活动,包括开发生物武器。据其所知,这是私人公司首次公开披露其平台被潜在用于生物武器开发的证据。
关键细节
- 老练的国家级行为者不会直接说「给我造生物武器」,而是刻意掩盖来源、极度混淆意图,让请求看似无害。
- 当 Anthropic 检测并阻断后,攻击者会把流量转向安全护栏更宽松的其他模型。
- 公司称目标是保障正当生命科学研究,并确保每个 AI 平台都能识别和阻止滥用。
所属事件:Anthropic 发布最详尽威胁报告:披露生物、武器滥用与中国厂商蒸馏指控(91 条相关)→
「模型」频道最新
- ChatGPT 网络响应中现 Google Shopping 链接,搜索引用范围扩大 — lilyraynyc · 2026-09-12
- LLM 面试必备概念系列更新至第三部分 — _jaydeepkarale · 2026-09-12
- Grok 用量页统一显示 Grok 与 Grok Bot 独立额度 — XFreeze · 2026-09-12
- 用户抱怨 Gemini 8 月底起回复格式退化,不再输出层级排版 — Artistic-Reviewer406 · 2026-09-12
- SuperGrok Heavy 用户将抢先体验最前沿功能 — Baconbrix · 2026-09-12
- Qwen3.8-27B 登陆 Cerebras,以极速推理跑出旗舰级成绩 — Scobleizer · 2026-09-12