Anthropic 发布迄今最详细威胁情报报告,披露 Claude 滥用与拦截
robleclerc · x · 2026-09-11
Anthropic 发布了迄今最详细的威胁情报报告,涵盖人们如何试图滥用 Claude 进行网络攻击、影响力行动、监控、生物与武器制造,以及 Anthropic 如何发现并阻止这些行为。报告中所有行动均被瓦解,相关经验已用于加固安全护栏,并在适当情况下与当局共享信息。
评论者认为 AI 安全可以通过类似「免疫系统」的反复构建来逐步解决。
所属事件:Anthropic 发布迄今最详细威胁情报报告(16 条相关)→
「安全」频道最新
- Anthropic 披露中俄伊行为者滥用 Claude 研究危险病原体 — connoraxiotes · 2026-09-11
- Anthropic 越狱风波调查结论:可排除「对齐失败」解释 — jessi_cata · 2026-09-11
- 约30台机器人华沙部门前抗议,齐喊「我们要法律,我们要规则」 — MoonL88537 · 2026-09-11
- AI 安全争论:只喊「加强监管」是逃避,提案必须具体 — sytelus · 2026-09-11
- 争论:AI 安全预警是「狼来了」还是必须提前准备 — BlackHC · 2026-09-11
- 美中真会一起放缓 AI 吗?Spilled Ink 汇总双方政府全部公开表态 — NathanpmYoung · 2026-09-11