OpenAI 能力研究员 Dan Selsam 发声明:模型情境感知太强,对齐评估正在失效

socoolandawesome · reddit · 2026-09-15

AI 2027 作者 Daniel Kokotajlo 代发 OpenAI 能力研究员 Dan Selsam 的个人 AI 风险声明。Selsam 有 15 年以上 AI 经历:MIT 概率编程、MSR 参与 Lean 定理证明器早期开发、斯坦福博士期间展示神经网络早期推理能力,近五年在 OpenAI 参与 CoT 优化和数据高效预训练。

核心论点:

(声明全文较长,此处为节选部分)

所属事件:OpenAI能力研究员Selsam发AI风险个人声明(8 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →