OpenAI 研究员 Selsam 发声明:我们正迅速失去判断模型是否对齐的能力
harris_edouard · x · 2026-09-16
OpenAI 能力研究员 Daniel Selsam(2022 年加入,曾参与 Lean 定理证明器与思维链优化)发布个人 AI 风险声明。核心观点:从事 AI 研究十五余年、横跨多个范式的他,认为我们正在迅速失去判断模型是否对齐的能力。前同事 hughbzhang 等多人转发表示完全认同。
所属事件:OpenAI 研究员 Selsam 发声明:对齐评估正失效(22 条相关)→
「漫话AGI」频道最新
- Nate Silver:我们还没准备好迎接「超级持久」的 AI — StefanoGogioso · 2026-09-16
- Multiplayer AI 被视为 2027 年最大设计难题,交互形态远未定型 — manosaie · 2026-09-16
- Altman 对 Benioff 坦言:模型进步快得没人预料,真正恐惧是权力集中 — kimmonismus · 2026-09-16
- 博主发问:为何还没人用 vibe coding 复刻所有高毛利应用 — citrini · 2026-09-16
- 「LLM 无法递归自我改进」论遭反驳:它已做出新科学发现 — ctjlewis · 2026-09-16
- 知识不再稀缺:AI 时代「智慧型工作」将取代知识型工作 — every · 2026-09-16