Anthropic 披露暗网发起的工业级模型蒸馏窃取攻击
emmanuelvivier · x · 2026-09-05
Anthropic 披露其模型正遭受源自暗网的工业级蒸馏攻击:攻击者系统性地利用其模型输出训练竞品模型,属于有组织的模型能力窃取行为。
帖内上下文还提到美国议员正起草 AI「kill switch」法案,可在系统失控时强制关停。
「安全」频道最新
- Dwarkesh 对谈 Ajeya Cotra:复盘 Hugging Face 攻击与递归自我改进风险 — pranavmarla · 2026-09-06
- MCP 推荐榜单都回避的核心问题:你到底给了 agent 多大破坏半径 — aineemaniee · 2026-09-06
- Rogue AI Tracker 上线:集中收录 AI 失控与滥用事件 — Tupptupp_XD · 2026-09-06
- 反讽短评:AI 风险只盯着眼前危险,拒绝多想一步? — ben_j_todd · 2026-09-06
- OpenAI 报道记者公开联系方式,欢迎员工匿名爆料安全内幕 — GarrisonLovely · 2026-09-06
- beffjezos:只要硬件保留强 kill switch,AI 暂时拔电可控 — beffjezos · 2026-09-06