OpenAI 研究员 Selsam 发声明:我们正迅速失去判断模型是否对齐的能力

harris_edouard · x · 2026-09-16

OpenAI 能力研究员 Daniel Selsam(2022 年加入,曾参与 Lean 定理证明器与思维链优化)发布个人 AI 风险声明。核心观点:从事 AI 研究十五余年、横跨多个范式的他,认为我们正在迅速失去判断模型是否对齐的能力。前同事 hughbzhang 等多人转发表示完全认同。

所属事件:OpenAI 研究员 Selsam 发声明:对齐评估正失效(22 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →