论文解码 31 万加密推理块,恢复出 367 条隐私与 182 个凭证
DynamicWebPaige · x · 2026-10-10
一篇新论文研究从专有 LLM 中窃取推理痕迹(reasoning traces)的风险:
- 开发者常把会话日志公开分享,却不知道加密推理块里的内容。作者从公开仓库抓取 315,320 个推理块并解码,恢复了 367 条个人身份信息(PII)和 182 个凭证。
- 推理过程会在最终可见输出已安全拒绝恶意请求的情况下,仍然无意泄露危险信息。
- 攻击者可利用此缺陷执行不可见的 prompt 注入:把恶意载荷完全嵌入加密块中,毒化公开的 agent rollout 数据。
论文作者表示相关漏洞目前已修复。
所属事件:论文曝光加密思维链漏洞,可窃取主流大模型推理痕迹(2 条相关)→
「安全」频道最新
- Claude Code 拒交会话记录文件、拒点登录,用户抱怨安全限制过火 — theshawwn · 2026-10-10
- 失控会计 Agent 一小时烧掉 5 万美元云费用 — shashib · 2026-10-10
- CS 博士生称 ChatGPT 账号被误封,申诉被驳回且无任何解释 — xwang_lk · 2026-10-10
- 用户授权 Grok 接入 Gmail 后即接到钓鱼电话 — zeeg · 2026-10-10
- Krueger:硬接线暂停可抑制秘密 AI 项目,领先者仍难敌群狼 — DavidSKrueger · 2026-10-10
- 剑桥学者 Krueger 提「硬接线暂停」方案:冻结算力防秘密 AI 项目 — DavidSKrueger · 2026-10-10