观点:基于强化学习的 AI 无法实现 RSI,因奖励函数设计难

kchonyc · x · 2026-08-19

作者认为基于强化学习(RL)的 AI 无法实现递归自我改进(RSI)。原因在于我们必须设计奖励函数,而在设计奖励函数这件事上,人类处于递归的糟糕状态(即我们本身就不擅长设计它,且难以通过自身改进来解决这个问题)。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →