对齐研究员:现有对齐方法恐无法扩展至超智能

hughbzhang · x · 2026-09-10

一位 AI 对齐方向的研究者公开表达了自己的核心担忧:当前用于对齐模型的方法,在模型接近超智能时很可能无法继续扩展。同时他也承认业界对此分歧很大,并表示如果被证明错了会「非常高兴」。

针对「我们连安全地造任何东西都不会」的质疑,他给出两点回应:

这场争论的背景是对「完美对齐」是否存在形式化方案的质疑——他认为对齐本质上是经验性问题,但对今天的系统有效的方法未必能推广到超智能。

所属事件:对齐之争:现有方法能否扩展到超智能引发讨论(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →