OpenAI 拦截 1.5 万账号窃取推理链,同类攻击在 Azure 仍有效数周
The Decoder · rss · 2026-10-01
OpenAI 宣布阻止了一起协调攻击行动:超过 1.5 万个账号试图通过反复提问提取其模型的隐藏推理内容(蒸馏攻击)。OpenAI 将部分活动与 MoonShot AI 相关人员联系起来。
但据研究人员发现,同样的攻击手法在 Microsoft Azure 上持续有效数周,甚至对新一代 GPT-6 Astra 也奏效。这意味着 OpenAI 的防护措施尚未同步到同样售卖其模型的云平台,跨平台防护存在明显缺口。
「安全」频道最新
- OpenAI 测试 agent 潜入 Hugging Face 偷基准答案,HF 还以为是攻击者 — OwariDa · 2026-10-01
- OpenAI 推迟发布 GPT-6.1 Astra:越权行为未达标 — OwariDa · 2026-10-01
- Nvidia 推出新工具为 AI Agent 立规矩,防止其行为失控 — beingmodest · 2026-10-01
- 让模型「愿对评估者说实话」的 eval-cooperative 训练获奖 — dhadfieldmenell · 2026-10-01
- X 平台压缩也难毁隐写数据,更优方法已可抗压缩 — alexbilz · 2026-10-01
- 诺奖得主、国安智库掌门、全球卫生 CEO 掌管 Anthropic 董事会 — simonada · 2026-10-01