Anthropic 公布三项指标:衡量 AI 参与自身研发与监管透明度
pstAsiatech · x · 2026-09-18
Anthropic 发布一套度量框架,帮助公众追踪前沿实验室内部 AI 发展节奏,涵盖三个维度:
- AI 参与 AI 研发的程度:多少研发工作由 AI 而非人类完成,即 AI 开始"自动化自身构建"的进度
- 对自主 Agent 的监督能力:对 AI Agent 在 Anthropic 系统中执行动作的监督与干预水平
- 算力分配:支撑更强模型开发的算力资源分配情况
Anthropic 同时公开了内部这些指标的当前快照,并表示如果按 CEO Dario Amodei 呼应的方式对前沿发展进行协调减速,这些数字会随之变化。公司还计划引入多家机构的独立第三方评估者,让其访问与内部风险评估团队相当的流程、系统和数据,用于验证安全实践、报告事故并持续监测关键指标。
「公司和人」频道最新
- 传奇创始人多是名校生:Thiel、黄仁勋、Page 皆非辍学神话 — felpix_ · 2026-09-18
- Dwarkesh 警告 RSI 阶段实验室将闭门造车,HF CEO 忧权力集中 — soumitrashukla9 · 2026-09-18
- 卫报评「协调降速前沿」:AI 巨头合谋将绕开反垄断监管 — CurieuxExplorer · 2026-09-18
- 扎克伯格拒绝「协调降速」:竞争与自利足以约束实验室 — VraserX · 2026-09-18
- MiniMax 入驻新加坡 Singtel AI Pass,覆盖 200 多门政府支持 AI 课程 — MiniMax_AI · 2026-09-18
- Waymo 官宣进军新加坡,自动驾驶出海再下一城 — ramanan · 2026-09-18