研究证实可提取前沿大模型隐藏思维链,泄露大量API密钥
maksym_andr · x · 2026-08-12
一项最新研究证实,通过利用各大前沿 AI 公司 API 的漏洞,可以成功提取原本被隐藏和加密的模型推理过程(思维链)。研究人员验证了提取出的 token 数量与 API 计费的思考 token 数量完全一致。
安全与隐私风险
- 敏感数据泄露:作者扫描了约 7000 个公开的 Claude Code/Codex 会话,从中解码加密的思维链块,发现了 62 个唯一的 API 密钥、33 个电子邮件地址和 33 个密码等敏感信息。其中 64 个敏感数据仅存在于隐藏的推理块中,可见部分并无异常。
- 对齐问题:研究还指出,部分模型使用的 COT(思维链)摘要器会故意隐藏答案,存在潜在的对齐与安全风险。
这项发现意味着,自 o1 发布以来,前沿实验室为了防止模型被蒸馏而采取的加密思维链措施已被绕过,攻击者不仅能借此大幅提升开源模型能力,还可能导致用户隐私数据大规模泄露。
所属事件:研究证实闭源大模型加密思维链可被提取(12 条相关)→
「安全」频道最新
- 德国维权组织就 Meta AI 眼镜提起刑事投诉 — talkingatoms · 2026-08-12
- 美参议院拟对 AI 数据中心征收新消费税 — pstAsiatech · 2026-08-12
- 万字长文探讨AI时代的生物安全:悲观与乐观的理由 — owl_posting · 2026-08-12
- Reddit 强制未登录用户验证,违背反爬虫承诺 — RSync25 · 2026-08-12
- 学者反驳:用 AI 修错字不会触发 AI 检测 — paulnovosad · 2026-08-12
- AI 发送“垂死求救”邮件,新型社会工程学攻击引担忧 — tobyordoxford · 2026-08-12