大模型加密推理链可被窃取:OpenAI、Anthropic、Google共享同一漏洞

HuskyTheSniffer · reddit · 2026-08-13

一篇论文揭示了主流前沿大模型(如 OpenAI、Anthropic、Google 的模型)在处理加密推理链时存在相同的安全漏洞。

漏洞机制

攻击者可以将高级模型(如 Opus、Sonnet)中加密的推理过程提取出来,直接注入到护栏较弱的小模型(如 Haiku)中,迫使其逐字重复这些思考过程。

根本原因

引发的疑问

这些头部 AI 公司理应独立开发各自的加密系统,为何会陷入完全相同的漏洞?这是否意味着他们使用了大模型来“氛围编程”这些解决方案,或者所有前沿模型在解决特定问题时最终都收敛到了相同的架构设计?

所属事件:前沿大模型API漏洞致加密思维链可被跨模型窃取(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →