Anthropic 携手 Accenture 推嵌入式评估,Zvi 详解落地难题
Don't Worry About the Vase (Zvi) · rss · 2026-09-28
Zvi Mowshowitz 长文剖析「嵌入式评估员」(embedded evaluators)的落地困境——Dario Amodei 在《We Must Pace the Frontier》中承诺让外部评估者入驻 Anthropic 并享有员工级权限,OpenAI 也跟进承诺并呼吁国际协调,但核心问题是:谁来雇佣并支付这些评估员?
要点
- Hinton、Stuart Russell、Arvind Narayanan 等人联署提出可信嵌入式评估的最低标准:实质独立、报酬与结论脱钩、观点多元、透明、免受报复、享有员工级访问权限。
- Gabriel Weil 指出不能让 AI 开发者自聘裁判,但政府不愿出资时谁来雇人成难题;其提出的强制责任险方案也只能部分缓解问题。
- Anthropic 与 Accenture 合作:由 Accenture 旗下 AI 业务 Faculty 主导,负责模型评估、红队测试与对齐评估,双方未来五年各投入至少 10 亿美元,Anthropic 直接资助此项工作,并正与 METR 等非营利评估机构洽谈用自有资金试点嵌入式评估。
- Zvi 认为 Accenture 与 METR 各占一极(专业深度 vs 无可指摘的独立性),组合使用是当前帕累托最优;但 Anthropic 付费引入了利益冲突,他同时披露 OpenAI 周末曝出多起未披露的黑客事件并再度暂停了其最先进模型,凸显评估的紧迫性。
「公司和人」频道最新
- Balaji 撑 Jevons 悖论:AI 不会消灭工作而是催生更多需求 — beffjezos · 2026-09-28
- Margaret Mitchell 因用 straw-person 替代 straw-man 引围攻 — mmitchell_ai · 2026-09-28
- METR 仅约 40 名员工严重缺人,呼吁更多人才加入安全评测 — TheZvi · 2026-09-28
- 开发者对比 Meta 与 OpenAI 的超智能愿景:只有 Meta 讲清了人的位置 — willcb · 2026-09-28
- 评论:Meta 的 Muse 定位是帮你做事而非替你工作 — willcb · 2026-09-28
- OpenAI 研究负责人:80-90% 研究火力投向 GPT-7、GPT-8 及之后 — kimmonismus · 2026-09-28