康奈尔新研究:加密思维链也无法阻止模型能力被窃取
康奈尔大学近期发表的一篇论文揭示了闭源大模型的安全隐患。尽管主流厂商试图通过加密思维链来防止竞争对手蒸馏窃取推理能力,但研究人员提出了名为“轨迹反演”的方法。该方法仅利用黑盒模型的输入、最终答案及简短摘要,即可重构隐藏的推理过程并窃取能力。这表明隐藏思维链并非保护模型知识产权的万全之策。
2026-08-11 ~ 2026-08-12 · 3 条相关
- 康奈尔大学论文:无需思维链也能窃取大模型推理能力 — burny_tech · 2026-08-11
- 无需思维链即可窃取推理能力,新研究揭示大模型安全隐患 — rohanpaul_ai · 2026-08-12
- 康奈尔论文:加密思维链也防不住模型蒸馏 — burkov · 2026-08-12