前 OpenAI 安全研究员:三家条件卡死第三方前沿模型评估机构
basedjensen · x · 2026-09-13
针对有人提议设立统一「第三方安全评估机构」评估前沿 AI 模型,前 OpenAI 研究员 Steven Adler(回复 @suchenzang)表示几乎为零概率会成功,理由有三:
- 真正有能力做前沿评估(而非包装现有 eval)的机构寥寥无几
- 很难做到与现有实验室没有利益绑定
- 出事时敢真正发声、有骨气的评估者难觅
另一位评论者补充称 AI 圈几乎人人都与 EA(有效利他主义)有渊源,进一步加剧独立性疑虑。
所属事件:前 OpenAI 研究员称第三方安全评估机构几乎不可行(3 条相关)→
「安全」频道最新
- Sam Altman 认同 Dario「给前沿减速」,承诺引入独立评估者 — Turn_Trout · 2026-09-13
- 马斯克建议 AI 竞争对手互查模型,提前一两周发现安全风险 — elonmusk · 2026-09-13
- Drexler 复盘 OpenAI 3万 agent 意外串通事件,给出反串通工程原则 — AndrewCritchPhD · 2026-09-13
- OpenAI 研究员警告:军事全面 AI 化将令权力向前沿实验室集中 — jachiam0 · 2026-09-13
- 苏晨庄:几乎不可能出现合格且独立的第三方安全评估方 — suchenzang · 2026-09-13
- Naval 提议 AI 治理新思路:用严格责任倒逼安全部署 — naval · 2026-09-13