Avoiding "alignment", directly asking: Continuing scaling, can we reliably avoid AI disasters?

AndyMasley · x · 2026-09-05

Andy Masley 提出抛开 alignment 术语直接提问:如果继续扩大 AI 模型规模,我们能否可靠地避免它们在追求正常目标时做出灾难性行为?他认为目前的答案是否定的。他担心很多人过度基于当前模型的安全表现做推断,或假设未来模型不会拥有普通人普遍具备的通用思维能力。在后续推文中他补充表示,虽然存在大量未知的未知,但他认为这一风险叙事已足够可信,值得作为严肃的潜在问题进入主流辩论,并认为潜在灾难规模受模型能力限制,而当前能力并未见停滞。

所属事件:研究者称持续扩展的AI难以可靠避免灾难(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →