Noam Brown 深谈:判断 AI 是否真正对齐正变得越来越难
Dwarkesh Patel · youtube · 2026-09-20
Dwarkesh Patel 发布对 OpenAI 知名研究员 Noam Brown 的长篇访谈,主题是「AI 是否真正对齐正越来越难判断」。
Brown 是 reasoning 模型领域的代表人物(曾主导 Libratus/Pluribus 扑克 AI 与 OpenAI o 系列推理工作),他与 Dwarkesh 围绕模型能力快速提升后,对齐评估与验证的困难展开讨论,是了解前沿实验室内部对齐思考的重要素材。
所属事件:Noam Brown 深谈:OpenAI 主攻递归自我改进,对齐更难判断(2 条相关)→
「安全」频道最新
- Gary Marcus:连 Anthropic 都没有让 AI 安全的理论,他们自己也不声称有 — GaryMarcus · 2026-09-20
- 用户惊觉 Gemini 记住了城市学校等大量个人隐私信息 — historical_cats · 2026-09-20
- 深度伪造泛滥,Science 探访数字取证专家如何反击 — ssh4net · 2026-09-20
- Gary Marcus 批诉讼:细节聪明、大局愚蠢,原告或无起诉资格 — GaryMarcus · 2026-09-20
- NY Post 报道被批:所谓『内部人士』只是两家小软件公司创始人 — trevposts · 2026-09-20
- WSJ 复盘 Hugging Face 代理攻击:不是 AI 叛变,是人写的指令 — austinc3301 · 2026-09-20