实证研究:LLM 首次事实回忆时是否真的自信?
Any-Chipmunk5480 · reddit · 2026-08-12
一位开发者通过 60 余次本地实验,试图在 Gemma 模型的 logprobs 中寻找「自信但错误」的事实回忆。
核心发现:
- 在推理链的首次事实回忆阶段(尚未受到自条件化影响前),模型极少表现出绝对自信的错误。当模型首次回忆出错误事实时,其内部实际上是不确定的(例如正确与错误答案的概率分布十分接近)。
- 幻觉的固化:一旦模型在低概率下生成了错误答案,它会在后续的推理或输出中通过自我强化,对该错误答案产生接近 100% 的置信度。
这表明模型的「自信」往往发生在生成之后,而非首次回忆的瞬间。
所属事件:开发者实测利用 logprobs 监测 LLM 幻觉(2 条相关)→
「研究」频道最新
- 神经外科医生借 ChatGPT 破解数学线性代数难题 — stevenstrogatz · 2026-08-12
- 曝 Ilya Sutskever 转向测试时训练,SSI 打造全新推理引擎 — iruletheworldmo · 2026-08-12
- 汇集 80+ 大厂 300 个真实 ML 系统设计案例 — mdancho84 · 2026-08-12
- Muse Glimmer 30B微调教程:点击定位准确率飙升至41% — mervenoyann · 2026-08-12
- 450M参数塞进物理认知:Liquid Crow微型世界模型发布 — helloiamleonie · 2026-08-12
- 图灵研究所指出网络攻击数据存在关键盲区 — turinginst · 2026-08-12