前沿模型推理痕迹短暂可读,加密推理仍可被模型自身解密

lbeurerkellner · x · 2026-08-14

作者评论称,前沿模型的推理痕迹曾短暂可读,开放研究社区几乎为此欢呼。但加密推理只是半隐藏的:无论查询哪个模型,它都必须解密先前的推理才能继续,因此明文总是可以通过模型本身获取。

所属事件:欧洲团队破解三大顶级大模型加密思维链(13 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →