只需两次 API 调用,新攻击还原 AI 隐藏的推理过程

jbhuang0604 · x · 2026-08-24

研究人员展示了一种针对前沿模型的新型攻击方法,只需两次 API 调用即可提取模型原本加密隐藏的“思维链”推理过程。攻击原理是将加密的推理轨迹回放到较弱的模型中,从而恢复出隐藏的推理内容。视频展示了多个有趣的推理提取实例,揭示了模型在输出隐藏思考过程时的安全漏洞。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →