抑制幻觉的进步更难得:幻觉根在预训练
teortaxesTex · x · 2026-07-07
作者认为某模型在抑制幻觉方面的进步尤其令人印象深刻。
其观点是:推理等正向认知能力较为稀疏,用 RL 几乎可以推进到任意远;但幻觉感觉与基础知识/预训练更相关(除非通过抬高拒答率来「作弊」绕过)。
「模型」频道最新
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- 新基准一出分数暴跌 70 点:「刷榜」现象如何让跑分失真 — airesearch12 · 2026-09-11
- ChatGPT 竟劝用户「问题太复杂,去试试更笨的回答」 — phido3000 · 2026-09-11
- Anthropic 调整年龄验证,Claude 不再向未成年人开放 — Muhammad523 · 2026-09-11
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11