新论文用强化学习提升 LLM 贝叶斯一致性与校准度
jessi_cata · x · 2026-08-23
论文《Rethinking LLM Confidence: From Calibration to Coherence》提出测量大模型概率的贝叶斯一致性程度,并利用来自利用的强化学习(RLE)训练模型,使其校准度更好。
「研究」频道最新
- 复数并非虚构,而是 LLM 并行处理语言的关键数学基础 — blaizedsouza · 2026-08-23
- Rich Sutton 观点:应让学习保持持续而非静态 — ricklamers · 2026-08-23
- 全绿监控掩盖了局部失效:4% 流量出坑的反思 — ClickOk5811 · 2026-08-23
- AI 欲攻克人类最高负担疾病,构建高质量科学数据基础 — iskander · 2026-08-23
- AI 代理明知结果错误仍提交,82.5% 自动化研究失败源于此 — rohanpaul_ai · 2026-08-23
- 可视化改进:一眼识别优劣的 LLM 评测统计方法 — IanArawjo · 2026-08-23