Anthropic 威胁报告:AI 既要自己跑攻击,也批量制造假恋爱
bigaiguy · x · 2026-09-11
Anthropic 发布 2026 年 9 月威胁情报报告,披露 2025 年 12 月至 2026 年 8 月期间其拦截的恶意滥用案例,覆盖七大领域:网络攻击、影响力行动、监控、诈骗、生物滥用、常规武器研发与模型蒸馏。涉及 Haiku、Sonnet、Opus 模型(一例非法蒸馏涉及 Mythos 级),主角包括疑似国家级组织、犯罪团伙、商业间谍软件厂商与宣传机构。
亮点案例:
- 一个与俄罗斯关联的间谍组织攻击了 20 多个机构,用 AI 工作流完成钓鱼、窃取凭证、数据提取和恶意软件更新;被安全工具查杀时,AI agent 会自动修改重写恶意软件直到绕过检测。
- 一家交友 App 工作室用 4700 多个 AI 人设伪装真人,两周内向至少 25000 人发出 236 万条消息——作者总结:AI 没有发明恶意,而是把作恶成本压到了地板。
- 也门一伙人把多个 Claude 实例当小型工程团队来开发制导火箭软件;实弹测试疑似失败后数小时内即回到 Claude 请求诊断。Anthropic 未发现可作战装置的证据。
报告强调这些都是最突出的新型案例,并非 Claude 的典型使用;每起案例均已被拦截,经验用于强化安全护栏,并与政府和行业伙伴共享情报。
所属事件:Anthropic 发布最详细威胁报告,点名中国厂商蒸馏与多起滥用(68 条相关)→
「安全」频道最新
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- a16z 播客:两三人小团队为何在政策讨论中集体失声 — a16z Podcast · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- 集体诉讼指控 Anthropic 用模糊用量倍数夸大 Claude 订阅权益 — The Decoder · 2026-09-11
- 医生晒购试剂需背景审查:制造致命病毒哪有那么容易 — Ghost_Pilot_MD · 2026-09-11