三大顶级 AI 加密思维链被破解,泄露 62 把 API 密钥
xiaohu · x · 2026-08-13
一支欧洲研究团队(8 月 10 日挂出论文)发现了一种可扩展的解密越狱方法,能够完整提取 OpenAI、Anthropic 和 Google 旗下旗舰模型的隐藏思考过程(思维链)。
漏洞机制
问题不在于加密算法本身被破,而在于 API 设计存在架构缺陷:加密块在同一提供商的不同会话、用户和模型之间是完全兼容且可互换的。攻击者可以将目标模型的加密推理块注入到同一提供商较弱且安全防护更低的模型中,迫使它解码并输出明文。
实际危害
- 绕过反蒸馏:可轻易窃取专有模型的推理逻辑进行盗版蒸馏。
- 大规模隐私泄露:开发者常在公开仓库分享会话日志。团队从网上抓取了 315,320 个加密推理块,解码后不仅恢复了 367 条个人身份信息(PII),还翻出了 62 把真实的 API 密钥。
所属事件:欧洲团队破解三大顶级大模型加密思维链(5 条相关)→
「安全」频道最新
- TrustedSec 深度文章:AI 进攻并非穿墙外挂 — cyb3rops · 2026-08-13
- 马萨诸塞州一青少年涉嫌在 ChatGPT 协助下杀害母亲与兄弟 — nbcnews · 2026-08-13
- AI 对齐研究者反思:现有 RLHF 与 HHH 框架过于简单 — sebkrier · 2026-08-13
- AI对齐探讨升温:多元视角聚焦价值与治理困境 — sebkrier · 2026-08-13
- 教授断言:再强的 ASI 也造不出无法破解的 AI 水印 — emollick · 2026-08-13
- 跨公司 Agent 交互对齐:Claude 与 GPT 会串谋吗? — jeremiecharris · 2026-08-13