破解前沿模型加密思维链,研究成功提取隐藏推理过程

soumitrashukla9 · x · 2026-08-11

一项新论文展示了如何从前沿模型中提取隐藏的推理过程。研究人员利用安全护栏较弱的模型(如 Llama、Haiku)对加密的思维链进行解密,并输出解码版本。

主要发现包括:

所属事件:研究揭示API漏洞可提取加密思维链并现蒸馏证据(38 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →