Anthropic 滥用报告:拦截危险生物请求,点名 7 家中国实验室蒸馏 Claude
rohanpaul_ai · x · 2026-09-11
Anthropic 最新"AI 滥用"报告披露多项敏感发现:
- 生物安全:报告描述了 5 起生物滥用案例,包括禽流感研究、涉及某军事研究机构的基孔肯雅病毒基金申请书;Anthropic 已拦截使病毒更危险的请求。
- 封号无效:对涉事研究者的封禁并未阻断访问——一家转售商几天内就恢复了服务,相关研究仍在继续。
- 模型能力变化:Anthropic 此前评估旧版 Claude 能力不足以实质性帮助专家开展危险生物研究,但对新模型已无法给出同样保证,因此扩大了生物类请求的限制范围。
- 中国实验室蒸馏:Anthropic 称发现 7 家中国实验室的未经授权蒸馏行动;并称 DeepSeek 和月之暗面曾把客户请求转发给 Claude、把回复包装成自家模型输出,导致敏感公司信息甚至有效凭证在客户不知情的情况下暴露给 Anthropic。
- 报告引出的行业问题:当供应商悄悄替换底层模型时,客户无法控制敏感信息的流向。
所属事件:Anthropic 发布最详尽威胁报告,披露生物滥用与中外多起拦截案例(52 条相关)→
「安全」频道最新
- AI Agent 研究者实测:LLM 对抗性验证码或成新防线 — voooooogel · 2026-09-11
- Aaron Levie 走访数十位企业技术高管:Agent 落地三大趋势 — inductionheads · 2026-09-11
- 加州立法限制聊天机器人,并禁止青少年使用成瘾性社媒 — Fcking_Chuck · 2026-09-11
- 实测打破幻觉:有人盯着的交互界面反成 agent 安全盲区 — Federal-Teaching2800 · 2026-09-11
- 评论者呼吁对前沿 RL 湿实验室实施更严格监管 — mimi10v3 · 2026-09-11
- 研究者指 OpenAI 退出训练条款存漏洞:隐藏 CoT 疑不受约束 — dhruv2038 · 2026-09-11