论文揭示如何从 API 提取加密推理链,你的 Session 日志正在泄密

Imaginary_Dinner2710 · reddit · 2026-08-12

近期一篇名为《Stealing Reasoning Traces from Proprietary LLM APIs》的论文引发了关注。研究人员发现,即使前沿大模型(如 Claude 3 Opus)对内部推理过程进行了加密,攻击者依然可以通过一些手段利用小模型(如 Haiku)对其进行解密,从而获取完整的思考链路,进而用于模型蒸馏。

核心安全风险

防护建议

不要将 API keys 等敏感信息直接暴露给模型。对于需要使用密钥的 Coding Agent,建议配置代理层进行加解密隔离,并务必为 API keys 设置严格的硬性消费上限。

所属事件:研究揭示API漏洞可提取加密思维链并现蒸馏证据(38 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →