康奈尔大学论文:无需思维链也能窃取大模型推理能力

burny_tech · x · 2026-08-11

康奈尔大学研究团队发表论文,指出即使大模型隐藏思维链,也无法阻止推理能力被“窃取”。

研究人员提出了轨迹反演方法,仅利用黑盒模型的输入、最终答案及可选的简短摘要,就能重构出详尽的合成推理轨迹。实验表明,使用这些反演轨迹微调学生模型,能显著提升其推理能力,实现从闭源模型中蒸馏知识。这证明了隐藏思维链并不能有效保护模型的底层推理逻辑。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →