欧洲团队破解三大顶级大模型加密思维链
一支欧洲研究团队(8月10日挂出论文)发表研究,证实主流前沿大模型(如 OpenAI、Anthropic、Google 的旗舰模型)的隐藏思维链(CoT)加密机制存在安全漏洞,可被完整提取,引发行业对 AI 安全与数据隐私的担忧。
已确认
- 漏洞机制:问题不在于加密算法本身被攻破,而在于 API 暴露了响应元数据(如始终可用的 ground truth token 数量)。研究人员指出,当提取出的 token 数量与 API 实际计费的思考 token 数量完全一致(几乎呈 1:1 对应)时,就能极高概率确认成功窃取了真实的思维链。
- 跨模型迁移:攻击者可以将从高级模型(如 Opus、Sonnet)中提取出的加密推理过程,直接注入到其他模型的护栏中,实现跨模型思维链迁移并用于越狱。
- 附带数据泄露:除了破解思维链,研究人员还从网上公开的 6708 份 AI 会话日志中提取出了 62 个真实的 API 密钥。
为什么重要
- 隐藏思维链是前沿大模型厂商保护模型推理能力、防止恶意越狱的重要安全护栏。此次被证实可被低成本提取且能跨模型迁移,意味着现有的 API 元数据暴露机制已成为系统性安全隐患,直接威胁到顶级 AI 模型的商业机密与安全防线。
2026-08-13 ~ 2026-08-14 · 13 条相关
- 第 1 集:研究揭示API漏洞可提取加密思维链并现蒸馏证据(2026-08-10,38 条)
- 第 2 集:闭源大模型思维链加密被证实可被窃取(2026-08-11,16 条)
- 第 3 集:密码学家Matthew Green批评前沿大模型厂商漠视安全研究(2026-08-11,5 条)
- 第 4 集:欧洲团队破解三大顶级大模型加密思维链(2026-08-13,13 条)
一手来源
- 欧洲团队破解顶级大模型加密思维链,泄露 62 把 API 密钥 — xiaohu ·
- 三大顶级 AI 加密思维链被破解,泄露 62 把 API 密钥 — xiaohu ·
- 研究证实:前沿模型API漏洞可提取隐藏思维链并跨模型迁移 — gsarti_ · 2026-08-13
- 大模型加密推理链可被窃取:OpenAI、Anthropic、Google共享同一漏洞 — HuskyTheSniffer · 2026-08-13
- 【源头】欧洲团队破解顶级大模型加密思维链,泄露 62 把 API 密钥 — xiaohu · 2026-08-13
- 研究揭示利用元数据可精准窃取大模型隐藏思维链 — npinto · 2026-08-13
- 团队解密前沿模型推理痕迹,发布可视化博客 — lbeurerkellner · 2026-08-14
- 弱模型可作解密预言机:前沿模型推理痕迹被成功解密 — lbeurerkellner · 2026-08-14
- 提示注入可被加密:攻击可植入加密块并重放至后续会话 — lbeurerkellner · 2026-08-14
- 加密推理与蒸馏:保护模型IP的难题 — lbeurerkellner · 2026-08-14
- 加密推理漏洞已缓解,但明文仍可通过模型获取 — lbeurerkellner · 2026-08-14
- 前沿模型推理痕迹短暂可读,加密推理仍可被模型自身解密 — lbeurerkellner · 2026-08-14
- 模型推理痕迹稀缺阻碍对齐研究,呼吁更开放的贡献 — lbeurerkellner · 2026-08-14
- 论文揭示实验室外难以获得对齐材料,呼吁多元化贡献 — lbeurerkellner · 2026-08-14
另有 1 条近重复转述:xiaohu