模型能自省找回被删 CoT 里的 token,机制却成谜

Sauers_ · x · 2026-10-09

Sauers 自省研究线程的开篇:实验发现模型能以高于随机的概率「自省」找回从其过往思维链(CoT)中被删除的 token。但两个关键问题悬而未决:从机制上讲这如何实现?以及为什么某些模型利用自省的结果,反而降低(而非提高)了自己在被追问时说出所想单词的概率?后续推文展开了实验细节与「藏动物」行为解释。

所属事件:研究称LLM可自省找回已删CoT信息,瓶颈在引导而非存储(6 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →