Vals 回应 Dario 放缓呼吁:独立评测已被所有大模型实验室采纳
Miles_Brundage · x · 2026-09-13
Vals AI 回应 Dario Amodei 关于「放缓前沿」的呼吁,认为业界领袖呼吁严格、独立的评测是积极信号。Vals 指出,AI 系统投资已远超我们测试与理解它们的能力,因此以市场为基础的评测机制是让公众对 AI 建立信心的最佳方式。
Vals 称已建成独立评测所需的基础设施与新方法,产出包括首个公开的 RSI 基准、前沿模型经济影响指数,以及针对社会安全网、网络风险与心理健康等维度的模型行为评测。其基准已出现在各大基础模型实验室的 model card 中,并定期向美国政府及国家安全机构做简报。
背景:Dario Amodei 此前发文主张 AI 行业应放缓,并提出三步计划;Anthropic 单方面承诺第一步——向第三方评测者提供永久、员工级别的系统访问权限,以核验安全措施、上报事故并评估训练中的模型对齐情况。
「漫话AGI」频道最新
- Gary Marcus:人类五年灭绝与一切都会好,两种叙事都荒谬 — GaryMarcus · 2026-09-14
- Gary Marcus:「五年内人类灭绝」与「一切都会没事」都是错的 — GaryMarcus · 2026-09-14
- 一种新直觉:30 年后正常的世界,多半是因为 AI 曾被暂停 — EigenGender · 2026-09-14
- Sam Altman 列出 AI 两大生存威胁:失控与权力过度集中 — sama · 2026-09-14
- Spotify 论文:Agent 时代推荐系统的受众正从人变成 AI — _reachsumit · 2026-09-14
- 公开信质疑前沿 AI 放缓呼吁:评估员只是通道,状态仍在推进 — AryHHAry · 2026-09-14