300 多篇论文综述:更强推理并不等于更会自知
blaizedsouza · x · 2026-07-21
一篇关于 LLM 元认知 的综述指出:模型推理能力更强,并不意味着它更会判断自己是否出错。
- 作者综述了 300 多篇论文,发现更强的推理能力和更好的自我监控并不自动绑定。
- 以 DeepSeek-R1 为例,它在一些基础元认知任务上仍会失手,比如估计自己的推理长度、预测任务是否会成功。
- 论文的核心结论是:推理深度 ≠ 自我认知深度,甚至更强的推理能力可能伴随更差的元认知敏感性。
- 文中还系统整理了相关方法、评测、应用场景、开放问题和一个 GitHub 论文清单。
「研究」频道最新
- 中国 AI 实验室把蒸馏混淆当成头号研究主题 — pmddomingos · 2026-07-22
- 研究发现,结构集成比单一预测更能提升 TCR:pMHC 泛化 — quaidmorris · 2026-07-22
- RSS 加入 OMSF,推进结构生物学大规模数据建模 — MoAlQuraishi · 2026-07-22
- enFoldX 在 8 个 neoantigen 数据集上拿到领先结果 — quaidmorris · 2026-07-22
- enFoldX 在 human VDJdb 上达 AUC 0.82 并可迁移到 mouse — quaidmorris · 2026-07-22
- enFoldX 利用 AF3 ensemble 分歧识别非结合对 — quaidmorris · 2026-07-22