康奈尔大学论文:无需思维链也能窃取大模型推理能力
burny_tech · x · 2026-08-11
康奈尔大学研究团队发表论文,指出即使大模型隐藏思维链,也无法阻止推理能力被“窃取”。
研究人员提出了轨迹反演方法,仅利用黑盒模型的输入、最终答案及可选的简短摘要,就能重构出详尽的合成推理轨迹。实验表明,使用这些反演轨迹微调学生模型,能显著提升其推理能力,实现从闭源模型中蒸馏知识。这证明了隐藏思维链并不能有效保护模型的底层推理逻辑。
「模型」频道最新
- 为合规欧盟AI法案,Anthropic将为Claude生成文本嵌入隐形水印 — ___Patrice___ · 2026-08-11
- 本地模型网页设计大比拼:Muse Glimmer 对决 Qwen 与 DeepSeek — ShadyShroomz · 2026-08-11
- Muse Glimmer 本地编码实测:20GB 内存可跑,能力不及 Qwen — curiousily_ · 2026-08-11
- Perplexity Agent API 上线 Kimi K3,附自动化数据报告实践 — AravSrinivas · 2026-08-11
- 仅改 PDF 文件名就能刷高分?研究揭示 LLM 评测易受暗示 — generativist · 2026-08-11
- DeepSeek 开源 OCR 2 模型:引入视觉因果流,精准转 Markdown — tom_doerr · 2026-08-11