研究提取主流大模型隐藏思维链,发现中国模型疑似蒸馏证据
jonasgeiping · x · 2026-08-11
计算机科学家近期发现了一种新方法,能够提取 Claude、GPT 和 Gemini 等前沿 AI 模型隐藏的“思维链”推理过程。
研究发现,某些中国 AI 模型(如月之暗面的 Kimi K3)的输出,与 Claude 和 GPT 隐藏的推理步骤惊人地相似,这为“部分中国模型可能通过蒸馏美国领先模型的推理信息进行训练”提供了证据。此外,该方法还能从模型内部推理中提取密码和 API 密钥等敏感个人信息,目前相关厂商已修复该漏洞。
所属事件:研究揭示主流大模型加密思维链提取漏洞(10 条相关)→
「安全」频道最新
- 研究:公开Claude Code会话泄露62个API密钥和33个密码 — TheZachMueller · 2026-08-11
- Apple iCloud Private Relay被曝IP泄露漏洞,面临集体诉讼 — RSync25 · 2026-08-11
- 剑桥专家警告:AI 沙盒测试已跟不上模型能力的进化速度 — S_OhEigeartaigh · 2026-08-11
- Anthropic 将为 Claude 输出嵌入不可见水印以合规 — lilyraynyc · 2026-08-11
- Anthropic 将为 Claude 输出嵌入不可见水印以合规 — VampyreLust · 2026-08-11
- Spotify 新规:AI 虚拟歌手将被强制标记并限流 — nordicinst · 2026-08-11