ICML 2026将举办RLxF研讨会,探索世界反馈强化学习

随着传统基于人类反馈的强化学习(RLHF)逐渐触及天花板,多所高校与 Google DeepMind 等机构的学者宣布,将在 ICML 2026 举办 RLxF(基于世界反馈的强化学习)研讨会。该会议旨在探讨将“世界环境本身”作为全新反馈信号的强化学习路径,以突破现有训练瓶颈。

嘉宾阵容与活动议程

据 @shaohua0116 公布的详细日程,这场将于 7 月 10 日举行的研讨会阵容强大。受邀嘉宾包括 Benjamin Eysenbach 和 Chelsea Finn 等人,Yilun Du 和 Yiding Jiang 也将加入座谈会环节。此外,会议设置了 5 场口头报告和两场海报展示环节,将集中展出 89 篇相关论文。

2026-07-09 ~ 2026-07-11 · 5 条相关

一手来源