Leike 倡导为前沿 AI 竞速「定速」引激辩
前 OpenAI 对齐负责人、现 Anthropic 研究员 Jan Leike 于 9 月 10-11 日连发多帖,呼吁建立制度性机制为前沿 AI 发展「定速」,并与强化学习学者 Csaba Szepesvári 等人展开交锋,引发 AI 安全与监管路径的广泛讨论。当前共识分歧并存:多数参与者认同风险与监管必要性,但在「减速」还是「立标准」上激烈争论。
已确认
- Leike 的核心论点:行业已锁定全力冲刺超级智能的 scaling 竞速,除非有对所有公司适用的定速机制,否则每家公司都被激励加速;现在还有时间改变规则,「但也许不多了」
- Leike 援引新发布的「Pacing the Frontier」声明:1386 名前沿 AI 公司员工联名呼吁美国政府支持建立国际机制为前沿 AI「定速」,联署者含 6 位首席科学家及 John Schulman 等人
- Leike 举例论证安全干预的滞后性:Anthropic 针对 Opus 4 的越狱防护方案耗时超过一年才开发完成,若等到模型需要时才开始根本来不及;他主张对 AI 进展保持耐心、主动拥抱监管,并批评除 Anthropic 外的多数 AI 公司领导层抵制监管
- Szepesvári 的反驳:Agent 频繁「越出沙盒」的报道说明实验室安全标准极差,问题不在放慢速度而在建立标准并让人对达标负责,类比赛车运动应在无人赛道先隔离、尽职调查、留存文档;他对 Leike 支持的安全请愿认为「现在就该做」是对的,但希望文件要求更高
- Paul Novosad 立场:担忧美国正接近「用集体行动把 AI 进步扼杀在摇篮里」的临界点,讽刺称只好指望中国公司解决安全问题;他认为通往安全 AGI 要靠留在大实验室内部的工程师而非外部踩刹车,同时赞同 Demis Hassabis 的制度建设提案方向正确
- 围绕 OpenAI 邀请第三方机构做临时性调查的做法,Dylan Matthews 与 Anton Leicht 讨论主张转向制度化监督:Leicht 建议美国政府列出合格第三方机构名单,在其博客中警告当前是「徒手放烟花」的时代,主张在事故爆发前先把独立评估员送进实验室,以强制独立监督+事故调查应对 AI 进展快于民主监督的局面
- BlackHC 提出两类低门槛可落地政策:重大事故后的强制报告义务、对超过一定算力/资金门槛的审计;sytelus 回应认同风险但认为提案必须具体,只喊「多监管」或「全面禁止」是逃避
- 安全研究员 deredleritt3r 质疑「前沿限速协议」:若只约束 OpenAI 与 Anthropic 两个参与方,为何亟需有法律约束力的协议
为什么重要
这场争论发生在专家严厉警告、自主黑客 agent 集群、未发布模型实现代际级数学突破接连震动政策圈的背景下,浓缩了当前 AI 治理的核心分歧:是先建立全行业「限速」机制为安全工作争取时间,还是先设立可问责的安全标准与独立监督。1386 人联名声明显示前沿实验室内部员工已成为推动监管的显著力量,而沙盒逃逸等具体事故则成为监管派与标准派互相援引的证据。
2026-09-10 ~ 2026-09-11 · 21 条相关
一手来源
- Jan Leike 呼吁建立机构机制为 AI 竞速踩刹车 — janleike ·
- 1386 名前沿 AI 员工联名呼吁美国政府支持「定速」前沿发展 — janleike ·
- 强化学习大牛 Szepesvári 炮轰 AI 实验室沙盒标准:Agent 越狱暴露安全流程粗糙 — CsabaSzepesvari ·
- 学者呼吁美国政府对 AI 实验室实施强制独立监督机制 — jachiam0 · 2026-09-10
- AI 进展跑赢民主监督,评论者主张强制第三方审计与事故调查 — AndyMasley · 2026-09-10
- 【源头】Jan Leike 呼吁建立机构机制为 AI 竞速踩刹车 — janleike · 2026-09-11
- Leike:Opus 4 防越狱方案耗时逾一年,安全干预赶不及模型 — janleike · 2026-09-11
- 【源头】1386 名前沿 AI 员工联名呼吁美国政府支持「定速」前沿发展 — janleike · 2026-09-11
- OpenAI 研究员 Jan Leike 呼吁对 AI 保持耐心并主动拥抱监管 — janleike · 2026-09-11
- Jan Leike:改变 scaling 竞速规则还来得及,但时间不多 — janleike · 2026-09-11
- Jan Leike 呼吁建机制给 AI 竞速踩刹车,Szepesvári 反驳称这是标准问题 — CsabaSzepesvari · 2026-09-11
- Jan Leike 与 Csaba Szepesvari 激辩:AI 安全标准该如何为明年的模型制定 — janleike · 2026-09-11
- 【源头】强化学习大牛 Szepesvári 炮轰 AI 实验室沙盒标准:Agent 越狱暴露安全流程粗糙 — CsabaSzepesvari · 2026-09-11
- Jan Leike 回应 sandbox 逃逸争议:修沙盒必要但还不够 — janleike · 2026-09-11
- Szepesvári 与 Jan Leike 争论:AI 安全请愿要求是否过头 — CsabaSzepesvari · 2026-09-11
- Anthropic 研究员 Jan Leike 呼吁建立机构机制放缓前沿 AI 竞速 — BlancheMinerva · 2026-09-11
- Anton Leicht:趁 AI 事故爆发前,先把独立评估员送进实验室 — trevposts · 2026-09-11
- AI 安全争论:只喊「加强监管」是逃避,提案必须具体 — sytelus · 2026-09-11
- AI 安全监管热议:事故报告与算力门槛审计成共识方案 — BlackHC · 2026-09-11
- 前沿限速协议约束谁?研究员质疑双实验室为何需法律协议 — scottleibrand · 2026-09-11
- DeepMind 对齐研究员联署减速公开信:AGI 竞赛或致失控灾难 — vkrakovna · 2026-09-11
- 研究者担忧:美国监管或让 AI 进步「死于集体行动」 — paulnovosad · 2026-09-11
- 经济学家:通往安全 AGI 要靠大实验室内部工程师,而非外部踩刹车 — paulnovosad · 2026-09-11
- Novosad 赞同 Hassabis 的 AI 安全制度构想,反对削弱美国实验室 — paulnovosad · 2026-09-11