Dario发文主张放缓前沿,Anthropic承诺向第三方开放员工级模型访问
ajratner · x · 2026-09-14
Dario Amodei 发表新文章《We Must Pace the Frontier》,主张 AI 行业应放慢速度,并提出三部分计划;Anthropic 单方面承诺落实第一步:为第三方评估者提供永久的、员工级权限的系统访问,使其可以核验安全措施执行情况、报告安全事件、并在训练期间评估模型对齐状况。
Stanford 的 ajratner 转发 Vincent Chen 的评论表示赞同,强调实现"更广泛、更精巧的评估体系"需要评估多元主义(eval pluralism):
- 更多基准:单一基准只测系统能力的一角,需要覆盖环境复杂度(单轮 prompt → 完整世界)、输出复杂度(固定 schema → 主观细腻产物)、自主时间跨度(单轮 → 持续改进的 agent)等维度
- 更多评估者:测量不应只掌握在一小群 AI 研究者手中,应引入领域专家等
- 开放的评估基础设施
所属事件:Dario长文呼吁放缓前沿AI,遭业内多方质疑(18 条相关)→
「安全」频道最新
- 研究:超 30% 搜索增强 LLM 回答完全不给来源署名 — iamtrask · 2026-09-14
- 桑德斯提议:推进超级智能的 AI 开发者可判 20 年监禁 — Kyrannio · 2026-09-14
- 活动家扮毁灭博士现身西雅图议会,抗议全市监控摄像头扩张 — jonerp · 2026-09-14
- METR 遭攻击:泄露 API 密钥三周烧掉约 60 万美元 — AlexTensor · 2026-09-14
- Epoch 研究员梳理「给 AI 降速」工具箱:限 RSI、限算力、限内部 Agent 预算 — connoraxiotes · 2026-09-14
- Altman、Amodei 等同意“放缓前沿”,AI 安全界迎来一批新机会 — Astral Codex Ten · 2026-09-14