新论文用强化学习提升 LLM 贝叶斯一致性与校准度

jessi_cata · x · 2026-08-23

论文《Rethinking LLM Confidence: From Calibration to Coherence》提出测量大模型概率的贝叶斯一致性程度,并利用来自利用的强化学习(RLE)训练模型,使其校准度更好。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →