Jan Leike Calls for Institutional Mechanisms to Pace Frontier AI Race, Sparking Debate

前 OpenAI 对齐负责人、现 Anthropic 研究员 Jan Leike 于 9 月 10-11 日连发多帖,呼吁建立制度性机制为前沿 AI 发展「定速」,并与强化学习学者 Csaba Szepesvári 等人展开交锋,引发 AI 安全与监管路径的广泛讨论。当前共识分歧并存:多数参与者认同风险与监管必要性,但在「减速」还是「立标准」上激烈争论。

已确认

为什么重要

这场争论发生在专家严厉警告、自主黑客 agent 集群、未发布模型实现代际级数学突破接连震动政策圈的背景下,浓缩了当前 AI 治理的核心分歧:是先建立全行业「限速」机制为安全工作争取时间,还是先设立可问责的安全标准与独立监督。1386 人联名声明显示前沿实验室内部员工已成为推动监管的显著力量,而沙盒逃逸等具体事故则成为监管派与标准派互相援引的证据。

2026-09-10 ~ 2026-09-11 · 21 related posts

Primary sources