研究者称递归自我改进下的价值稳定性未被证明

研究圈知名账号 l4rz 就“获得能力会改变原有关注点”的比喻发表观点,认为这类似 AI 安全中的价值稳定性问题,并指出在递归自我改进(recursive self-improvement)过程中,AI 系统的价值稳定性既没有被证明也没有被证伪,仍是未经充分验证的开放问题。讨论中还将其类比为孩子成长或接受教育后关注点转移的过程。

2026-09-01 ~ 2026-09-01 · 3 条相关