OpenAI 研究员亲见对齐风险证据后转向,安全派质疑其为何仍留下

aiamblichus · x · 2026-08-25

一位安全社区作者针对 David Manheim 的转述提出质疑:许多 OpenAI 研究员原以为错位(misalignment)危险只是理论、进展会是渐进的,但在亲眼看到强证据后,越来越多的人开始改变看法。

作者的批评点是:如果风险真到了需要拿朝鲜和国家安全作类比的程度,把 RSI 系统只交给 NSA 并不能避免失控,甚至可能更糟——面对这种级别的错位风险,唯一安全的做法是根本不造这台末日机器。他不解为何当事人还在为该公司工作。

所属事件:越来越多 OpenAI 研究员开始重视对齐风险(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →