Luiza Jarovsky:能力过阈值后,AI 对齐恐不再可行

LuizaJarovsky · x · 2026-10-07

AI 研究者 Luiza Jarovsky 发表争议观点:一旦 AI 能力跨过某个阈值,对齐(alignment)很可能就无法再实现了。她以「 unpopular opinion 」形式抛出这一判断,暗示对齐工作必须在模型能力到达临界点之前完成,超能力阶段的对齐或成不可能任务。帖子较短,未展开具体论证。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →