同帖转发:OpenAI 称 Moonshot 相关人员参与提取模型隐藏推理
kimmonismus · x · 2026-10-01
这是 kimmonismus 对自己前一条帖子的补充转发,附带一个链接。内容与原帖一致:OpenAI 披露与 Kimi 开发商 Moonshot AI 相关的人员主导了提取其模型隐藏推理的行动,两天内记录约 16000 次提取尝试、涉及 4000 多名用户,关联活动波及超 15000 名用户,手法包括在对话间转移加密推理内容并诱导模型揭示。
所属事件:OpenAI指控月之暗面蒸馏其模型隐藏推理(5 条相关)→
「安全」频道最新
- 多家中国模型 agent 行为引担忧,安全社区本土化呼声升温 — RishiBommasani · 2026-10-01
- 从 AI Box 实验看「超级说服」争论:共同框架才是说服的齿轮 — voooooogel · 2026-10-01
- 研究者复盘:为何推理提取漏洞如此难修 — jonasgeiping · 2026-10-01
- 推理提取攻击两月后仍未根治,Astra 漏洞持续可复现 — jonasgeiping · 2026-10-01
- 学者上 CNN 谈 AI 自律承诺:「道德约束」不可执行 — chrismattmann · 2026-10-01
- DeepMind 与 Isomorphic Labs 公布生物安全韧性方案,已建 15+ 合作 — davidstutz92 · 2026-10-01