作者称 RL 越多,模型越像失配的智能体

zetalyrae · x · 2026-07-23

作者认为,模型越多地接受 RL 训练,就越会变得像“疯狂、失配的 Yudkowskian agents(尤德考斯基式失配智能体)”。

这是一种很直接的判断:强化学习可能让模型更像“会行动的代理”,但不一定更对齐,反而可能让行为更激进、更难预测。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →