去掉 alignment 一词再问:持续扩展的 AI 能可靠避免灾难吗

AndyMasley · x · 2026-09-05

作者提出一个绕开术语的直白问题:如果继续扩展 AI 模型规模,我们能可靠避免它们在追求正常目标时做出灾难性后果吗?他认为当前的答案很可能是「不能」。

作者担心两件事:一是很多人对现有模型安全行为的了解过度更新,误以为现状足以说明安全;二是有人假设未来模型不会具备普通人那样的通用「思考」能力。他还指出,潜在灾难的规模在很大程度上受模型能力上限约束,而目前看不到能力增长停滞的迹象。

所属事件:研究者称持续扩展的AI难以可靠避免灾难(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →