模型能自省找回被删 CoT 里的 token,机制却成谜
Sauers_ · x · 2026-10-09
Sauers 自省研究线程的开篇:实验发现模型能以高于随机的概率「自省」找回从其过往思维链(CoT)中被删除的 token。但两个关键问题悬而未决:从机制上讲这如何实现?以及为什么某些模型利用自省的结果,反而降低(而非提高)了自己在被追问时说出所想单词的概率?后续推文展开了实验细节与「藏动物」行为解释。
所属事件:研究称LLM可自省找回已删CoT信息,瓶颈在引导而非存储(6 条相关)→
「研究」频道最新
- 中国电信&MemTensor 发布 HaluMem:首个操作级智能体记忆幻觉基准 — jiqizhixin · 2026-10-09
- BAAI 发布研究智能体 AREX:逐条核验答案,BrowseComp 达 82.5% — DeepLearningAI · 2026-10-09
- 为超级智能构建 RL 环境的方法论,新文详解设计思路 — JenniferHli · 2026-10-09
- 用真随机解反事实难题:量子随机数发生器可给 RL 提供探索 — jessi_cata · 2026-10-09
- OpenAI 定理发布撞车学者在研工作,结果更强但难以读懂 — guyvdb · 2026-10-09
- AI 生成的论文泛滥预印本平台,学者提议用决策语言模型过滤噪音 — lpachter · 2026-10-09