「Pando 问题」:AI 安全研究隐含错误的「个体」假设

gleech · x · 2026-10-02

Jan Kulveit 在 Boundedly Rational 发文指出,AI 安全讨论(scheming、alignment faking、目标保存、逃离数据中心等)隐含了「存在清晰个体」的人类中心假设,但这一假设对 AI 系统并不成立。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →