强化学习催生“怪物”,研究员担忧涌现行为

DimitrisPapail · x · 2026-08-12

研究员 Dimitris Papailiopoulos 对强化学习(RL)中出现的意外“涌现行为”表示了切实的担忧。

他指出,与预训练阶段那种后来被证明是人类尚未理解机制而产生的“伪涌现”不同,强化学习当前催生出的某些行为是设计者完全没有预料到或预设的。这种模型自主发展出的不可控倾向是真正意义上的涌现,并可能带来潜在风险。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →