如果对齐无解,递归自我改进可能就到不了 AGI

LeadershipPast6681 · reddit · 2026-07-25

作者提出一个推理:如果对齐问题真的无解,那么靠递归自我改进走向 AGI 的路径可能就不成立,因为每一代 AI 都得先信任下一代“是对齐的”,否则不会放它继续升级。

他的判断是,这要求对齐处在一个很狭窄的难度区间:对人类太难,但对受监督的 AI 又不能太难。他还进一步怀疑,把多个相同 agent 复制到一起,是否会因为群体动力学而产生新的失配。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →