Dario 发文呼吁 AI 行业降速,研究者质疑安全评估比算力限速更可博弈

gleech · x · 2026-09-13

Anthropic CEO Dario Amodei 发布新文《We Must Pace the Frontier》,提出 AI 行业应主动放缓的三步计划,并宣布 Anthropic 单方面承诺第一步:向第三方评估机构提供永久性的员工级系统访问权限,用于验证安全措施执行、报告事故并在训练期间评估模型对齐性。

研究者 Eli Lifland 转发并提出异议:Dario 认为基于 AI R&D 算力等投入端限速比基于安全评估/实践的限速更易被博弈,他认为恰恰相反——比如「要求将 90% 算力用于外部推理而非研发」就很难钻空子;而安全评估更难定义且更可博弈,AI 或公司可能操纵对齐评估,判断某项安全实践是否落实也很主观。但他仍支持逐步转向基于安全评估的限速。

所属事件:Anthropic CEO 发文呼吁统一放慢前沿 AI 发展(130 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →