COLM 2026 三篇论文详解:元认知奖励让 LLM 不确定性表达更忠实

armancohan · x · 2026-10-06

作者公布在 COLM 2026 的三篇论文安排:

作者欢迎现场交流 RL、持续学习/适应与训练科研智能体等话题。

所属事件:研究者预告 COLM 2026 将展示元认知奖励 RL 等三篇论文(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →