康奈尔论文:加密思维链也防不住模型蒸馏

burkov · x · 2026-08-12

主流闭源大模型厂商开始对模型的推理思维链进行加密,以防止竞争对手通过蒸馏窃取模型能力。然而,康奈尔大学近期发表的一篇论文提出了「Trace Inversion」框架,通过黑盒模型的最终答案和简短摘要,即可重构出详细的推理链条。

这项研究从技术上证明了,仅仅隐藏内部的思维链根本无法有效阻止模型被蒸馏,揭示了当前闭源厂商安全防护策略的局限性。

所属事件:康奈尔新研究:加密思维链也无法阻止模型能力被窃取(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →