OpenAI 安全协议撰写人 David Robinson 离职后首次受访
nytopinion · reddit · 2026-10-08
曾执笔 OpenAI 安全协议的 David Robinson 因安全担忧于上周辞职,在 Ezra Klein Show 上完成离职后首次访谈。
核心观点:
- 「我无法确定我们在面对文明级风险,但我非常确定:我们已经承受不起假设不存在这种风险。」这正是他离开的原因——继续为公司安全工作背书让他感到难以立足
- 核心悖论:你给一个被训练得极擅长绕过护栏的模型造护栏,再把它关进盒子里宣称出不来——前提是人类在「越狱」上始终比模型聪明,而这已经未必成立
- 他质疑自家 agent 日志与可观测性是否真的稳健,警告问题不限于 OpenAI 而是 AI 行业通病
NYT 已解锁全文,无需订阅即可收听。
所属事件:OpenAI 前安全协议撰写人 Robinson 离职受访:这太疯狂了(3 条相关)→
「漫话AGI」频道最新
- 陶哲轩谈「数学 1.0」:重大证明驱动的领域兴奋模式 — rms80 · 2026-10-08
- 「P = NP + AI」:RL 后训练让可验证问题全被自动化? — jessi_cata · 2026-10-08
- 中国连续两年 IMO 6 金全满,人均榜却永远赢不了罗马尼亚 — teortaxesTex · 2026-10-08
- 新型 AI slop:随手指控一切为 AI slop 本身正在变成 slop — rmn_pub · 2026-10-08
- 人人都能力造任意产品了,问题是谁也不知道自己要什么 — Paimaamu · 2026-10-08
- Schmidt「一年内出世界级 AI 数学家」预言被指正在应验 — inductionheads · 2026-10-08