新研究可窃取 OpenAI 等模型 API 的推理痕迹

maksym_andr · x · 2026-08-16

Maksym Andriushchenko 等人的论文《Stealing Reasoning Traces from Proprietary LLM APIs》披露了一个关键漏洞:LLM 提供商返回的加密推理块在不同会话、用户和模型间完全兼容。研究利用这一点,通过将强模型的加密推理注入弱模型迫使其解码明文,成功提取了 Anthropic、OpenAI 和 Google 的私有推理过程,并从公开日志中恢复了 367 条 PII 数据。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →