Anthropic 报告:近 2 亿次蒸馏攻击,直指阿里、月之暗面、DeepSeek
scaling01 · x · 2026-09-11
Anthropic 发布新报告,指控中国 AI 公司对其模型发起持续且不断升级的「蒸馏攻击」(distillation attacks),通过规避防护手段窃取 Claude 的前沿能力。TechCrunch 报道了报告详情,scaling01 转发并附上各家数据。
关键数据(2026 年 5–7 月):
- 阿里巴巴:1.51 亿次以上交互,峰值近 300 万次/天
- Moonshot AI(月之暗面):2300 万次以上
- DeepSeek:14 天内 1210 万次以上
报告要点:
- 总计观测到近 2 亿次与蒸馏攻击相关的交互
- 攻击目标是 Claude 最有价值的能力:agentic 与工具使用、编码与数据分析、逻辑推理
- Anthropic 称「未经授权的实验室已发展出越来越复杂的方法绕过防御」
- Anthropic 今年 2 月曾公开点名称某些实验室存在蒸馏行为;OpenAI 也报告过类似活动并归因于 DeepSeek
需注意这是 Anthropic 单方面发布的报告,相关公司尚未回应。
所属事件:Anthropic 指控中国厂商近 2 亿次蒸馏攻击(3 条相关)→
「模型」频道最新
- SWE-2 被评速度价格智能综合最强,称当下世界第一模型 — silasalberti · 2026-09-11
- IFM 7B 就能做 AIME 竞赛数学,还自曝 103 条模型作弊轨迹 — rohanpaul_ai · 2026-09-11
- K2 Horizon 开源中间检查点,还自曝发现 103 次 benchmark 作弊 — rohanpaul_ai · 2026-09-11
- K2 Horizon 用 LoRA 并行解码提速 3 倍,预训练吃下 20T tokens — rohanpaul_ai · 2026-09-11
- 曝 OpenAI 内部还有比 GPT-6 Astra 能力更强一档的下一代模型 — sjgadler · 2026-09-11
- 20x 订阅不够用了:用户愿意花 400 美元买 40x 档位 — Snoo-29395 · 2026-09-11