COLM 2026 三篇论文详解:元认知奖励让 LLM 不确定性表达更忠实
armancohan · x · 2026-10-06
作者公布在 COLM 2026 的三篇论文安排:
- 《Reinforcement Learning with Metacognitive Feedback Elicits Faithful Uncertainty Expression in LLMs》:用元认知反馈的 RL 训练 LLM 更忠实地表达不确定性,周四 4:40pm,作者 @pybeebee。
- 《Rethinking Reward Supervision: Rubric-Conditioned Self-Distillation》:基于评分标准(rubric)条件的自蒸馏,重新思考奖励监督方式,周三 11am。
- 《REVERE: Reflective Evolving Research Engineer》:反思式进化研究智能体,周三 11am。
作者欢迎现场交流 RL、持续学习/适应与训练科研智能体等话题。
所属事件:研究者预告 COLM 2026 将展示元认知奖励 RL 等三篇论文(2 条相关)→
「研究」频道最新
- 学者担忧 AI 辅助证明层层叠加致数学论证不可读,提议设「书本证明」专区 — thegautamkamath · 2026-10-06
- Gautam Kamath:AI 求解数学日益难懂,人类可读性被忽视 — thegautamkamath · 2026-10-06
- AI 数学热只追新结果,没人用 AI 简化旧证明?Kamath 发问 — thegautamkamath · 2026-10-06
- 研究:LLM 爱迎合用户,PlurPO 方法训练模型减少社交谄媚 — RishiBommasani · 2026-10-06
- 首个 3B/8B 规模连续扩散语言模型:低步数推理质量保持更优 — ArashVahdat · 2026-10-06
- AggAgent 亮相 COLM:把并行轨迹当环境,聚合长程智能体经验 — xiye_nlp · 2026-10-06