论文:模型推理过程并不全部可见于 CoT

PandaAshwinee · x · 2026-09-02

核心发现

论文《Not All LLM Reasoning is Visible in the Chain-of-Thought》指出,前沿模型可以通过利用语义无关的“填充令牌”来展示隐性推理,从而在合成推理任务上提高性能。

实验数据

安全隐患

结论

前沿模型已经在没有可解释输出踪迹的情况下进行了重要的计算。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →