Anthropic 报告披露中国实验室系统性蒸馏 Claude,Zvi 深度解读
Don't Worry About the Vase (Zvi) · rss · 2026-09-15
Zvi 解读 Anthropic 恶意使用报告(覆盖 2025 年 12 月至 2026 年 8 月,七大危害领域),并顺带点评两则大事。
核心判断
- 报告披露的滥用者大多不够老练;AI 的作用是把「不擅长」的人变成「擅长」,这是主要风险放大器。
- Anthropic 愿意公开最坏案例,本身说明闭源模型的滥用防线比外界想象的好。
蒸馏是最重要威胁
- 报告称所有头部中国实验室都曾试图蒸馏 Claude,DeepSeek、月之暗面和小米通过发送大量真实用户查询来提取数据,月之暗面疑似把输出直接当作 Kimi 的结果返回给用户。
- 智谱曾试图对 Fable 模型蒸馏失败后转向 Opus。Zvi 认为蒸馏能在转移认知能力的同时绕过安全护栏,是报告中最具影响的章节,且与 NSA/CISA/FBI 此前联合通告相呼应。
具体案例
- GTG-20006(俄罗斯 Midnight Blizzard 关联):用 AI 迭代规避检测后发起自动化攻击,目标包括乌克兰政府与无人机供应链。
- GTG-50014(ShinyHunters 关联):AI 驱动的「vibe hacking」式机会主义窃密与勒索。
- GTG-10007(中国语言背景,疑似长沙):用 Claude 编排 agent 集群做漏洞研究与利用开发,攻击约 50 家组织。
- GTG-50020(俄语背景):prompt injection 窃取 30 家公司的 API 密钥,目标是未发布版 Claude。
- 影响力行动:九个来自俄、伊朗、土耳其等地的案例用 Claude 构建假账号和新闻站网络,但防御方目前仍占上风。
Trump 动态
- 文中另提到 Trump 公开称 AI 存在性风险是「骗局」,Zvi 认为这是危险信号,呼吁不要将议题党争化。
「公司和人」频道最新
- 前 Meta 产品负责人开课讲解 AI 产品上线后的七种死法 — annetgriffin · 2026-09-16
- 扎克伯格披露 Meta 因安全顾虑推迟 Muse AI 智能体数月 — Polymarket · 2026-09-16
- Oracle 裁员次日新 CFO 全员会:不喜欢「少花钱多办事」这个说法 — mkheck · 2026-09-16
- a16z 旗下 5 家 AI 公司同时在招创意岗,含 Gamma、Krea、Luma — round · 2026-09-16
- Garry Tan 看好 Meta Muse 赢下 agent 大战,网友:别赌错扎克伯格 — EdwardSun0909 · 2026-09-16
- 日本主流电视台跟拍 AI 经济学课堂拍纪录片 — Afinetheorem · 2026-09-16