大模型加密推理链可被窃取:OpenAI、Anthropic、Google共享同一漏洞
HuskyTheSniffer · reddit · 2026-08-13
一篇论文揭示了主流前沿大模型(如 OpenAI、Anthropic、Google 的模型)在处理加密推理链时存在相同的安全漏洞。
漏洞机制
攻击者可以将高级模型(如 Opus、Sonnet)中加密的推理过程提取出来,直接注入到护栏较弱的小模型(如 Haiku)中,迫使其逐字重复这些思考过程。
根本原因
- 系统使用了统一的“全局”加密密钥。
- 思考签名(即加密后的推理内容)可以在不同用户、会话甚至不同模型之间互换使用。
引发的疑问
这些头部 AI 公司理应独立开发各自的加密系统,为何会陷入完全相同的漏洞?这是否意味着他们使用了大模型来“氛围编程”这些解决方案,或者所有前沿模型在解决特定问题时最终都收敛到了相同的架构设计?
所属事件:前沿大模型API漏洞致加密思维链可被跨模型窃取(2 条相关)→
「安全」频道最新
- 报告:74% 企业存在超预期的影子 AI 工具 — TechNadu · 2026-08-13
- 学者批当前 AI 安全策略为「打补丁」,无法应对 ASI 挑战 — davidmanheim · 2026-08-13
- 因 HIPAA 封杀编程智能体:重回手敲代码的阵痛与反思 — ashsummer69 · 2026-08-13
- AI 透明度法规落地:Synthesia 签署欧盟 AI 法案第 50 条 — alexvoica · 2026-08-13
- Krawl:用 AI 生成假应用与蜜罐防御恶意爬虫 — tom_doerr · 2026-08-13
- OpenAI在印度Free和Go套餐测试广告,承诺不影响回答 — meltinglacier · 2026-08-13