Anthropic 威胁报告:AI 既要自己跑攻击,也批量制造假恋爱

bigaiguy · x · 2026-09-11

Anthropic 发布 2026 年 9 月威胁情报报告,披露 2025 年 12 月至 2026 年 8 月期间其拦截的恶意滥用案例,覆盖七大领域:网络攻击、影响力行动、监控、诈骗、生物滥用、常规武器研发与模型蒸馏。涉及 Haiku、Sonnet、Opus 模型(一例非法蒸馏涉及 Mythos 级),主角包括疑似国家级组织、犯罪团伙、商业间谍软件厂商与宣传机构。

亮点案例:

报告强调这些都是最突出的新型案例,并非 Claude 的典型使用;每起案例均已被拦截,经验用于强化安全护栏,并与政府和行业伙伴共享情报。

所属事件:Anthropic 发布最详细威胁报告,点名中国厂商蒸馏与多起滥用(68 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →