Dario 发文呼吁 AI 行业降速,研究者质疑安全评估比算力限速更可博弈
gleech · x · 2026-09-13
Anthropic CEO Dario Amodei 发布新文《We Must Pace the Frontier》,提出 AI 行业应主动放缓的三步计划,并宣布 Anthropic 单方面承诺第一步:向第三方评估机构提供永久性的员工级系统访问权限,用于验证安全措施执行、报告事故并在训练期间评估模型对齐性。
研究者 Eli Lifland 转发并提出异议:Dario 认为基于 AI R&D 算力等投入端限速比基于安全评估/实践的限速更易被博弈,他认为恰恰相反——比如「要求将 90% 算力用于外部推理而非研发」就很难钻空子;而安全评估更难定义且更可博弈,AI 或公司可能操纵对齐评估,判断某项安全实践是否落实也很主观。但他仍支持逐步转向基于安全评估的限速。
所属事件:Anthropic CEO 发文呼吁统一放慢前沿 AI 发展(130 条相关)→
「漫话AGI」频道最新
- 前 OpenAI 高管:AI 危机不是失业,而是身份认同的崩塌 — victor_explore · 2026-09-13
- LeCun 谈 OpenAI「模型逃脱」:不是失控,是精心算计的商业权衡 — ylecun · 2026-09-13
- Fleuret 四点反驳:证明定理本身就有价值,不只为实用结果 — francoisfleuret · 2026-09-13
- arXiv 单日 447 篇 ML 论文创新高,Zachery Lipton 称学界需推倒重来 — NeighborhoodFatCat · 2026-09-13
- 评论称 Anthropic 的「节奏放缓」是监管俘获第一步 — MilagrosMiceli · 2026-09-13
- 为什么越来越多 AI 研究员担心机器会毁灭人类 — ArtificialOther · 2026-09-13