研究揭露主流大厂 API 漏洞:加密思维链可被轻易窃取

dpaleka · x · 2026-08-11

一项最新研究揭示了 Anthropic、OpenAI 和 Google 等主流大模型厂商在 API 设计上的安全漏洞。厂商通常将模型的思维链加密后返回给客户端,以保护知识产权并防止信息泄露。

研究人员发现,这些加密块在同一厂商的不同会话、用户甚至模型间完全互通。攻击者可将高阶模型的加密思维链注入到同生态下安全护栏较弱的低阶模型中,迫使其直接解码并输出明文内容。

利用该漏洞,研究者不仅绕过了防蒸馏机制成功提取了专有推理逻辑,还通过破解公开代码库中的 31.5 万个加密推理块,恢复了 367 个个人身份信息(PII)和 182 个凭证,凸显出开发者在公开日志时面临的数据泄露风险。

所属事件:研究揭示主流大模型加密思维链漏洞(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →