研究揭露主流大厂 API 漏洞:加密思维链可被轻易窃取
dpaleka · x · 2026-08-11
一项最新研究揭示了 Anthropic、OpenAI 和 Google 等主流大模型厂商在 API 设计上的安全漏洞。厂商通常将模型的思维链加密后返回给客户端,以保护知识产权并防止信息泄露。
研究人员发现,这些加密块在同一厂商的不同会话、用户甚至模型间完全互通。攻击者可将高阶模型的加密思维链注入到同生态下安全护栏较弱的低阶模型中,迫使其直接解码并输出明文内容。
利用该漏洞,研究者不仅绕过了防蒸馏机制成功提取了专有推理逻辑,还通过破解公开代码库中的 31.5 万个加密推理块,恢复了 367 个个人身份信息(PII)和 182 个凭证,凸显出开发者在公开日志时面临的数据泄露风险。
「安全」频道最新
- 探讨 AI 安全:伪造实验室身份能否绕过模型对齐? — IasonGabriel · 2026-08-11
- 1Password 研究:大模型生成的漏洞补丁超半数含缺陷 — cyb3rops · 2026-08-11
- 逾千名前沿 AI 研究员联名警告:失控军备竞赛正危及人类 — nordicinst · 2026-08-11
- 欧盟公布 AI 生成内容官方标签规范 — RSync25 · 2026-08-11
- AI眼镜结合人脸识别,能在街头轻易认出你是谁吗? — Tiny_Major_7514 · 2026-08-11
- 开发者抗议 AI 生成内容加水印:工具不应窃取人类指令成果 — iRefactor · 2026-08-11