Anthropic 联手埃森哲做嵌入式评估,双方各投至少 10 亿美元
matthewclifford · x · 2026-09-19
Anthropic 宣布与埃森哲合作,对前沿 AI 模型开展独立评估,这是落实 CEO 文章《We Must Pace the Frontier》中「嵌入式评估员」承诺的一步。
- 合作由埃森哲旗下 AI 业务 Faculty 牵头,内容包括模型评估与红队测试、对齐评估、安全护栏测试。
- 与传统外部评估员不同,嵌入式评估员将以近似员工的权限深入公司内部:观察训练中的模型、追踪构建与部署决策、直接与员工沟通,从而验证公司是否履行安全承诺、发现盲点并报告事故。
- Anthropic 与埃森哲各自预计在未来五年内投入至少 10 亿美元建设这一能力。
- Anthropic 承认嵌入式评估尚无成熟的访问标准、汇报机制与资助体系,并强调评估不减轻自身的安全责任,只是让责任更可验证。
「公司和人」频道最新
- Neuralink 帮助 ALS 患者恢复说话能力 — ZeroStateReflex · 2026-09-19
- PyTorch 大会将讲 Muon 优化器与 fastsafetensors 等推理效率新工具 — PyTorch · 2026-09-19
- 博主调侃:与政府和大企业关系密切的 Scale AI 无人讨论 — willcb · 2026-09-19
- 投资人盛赞 Databricks CEO Ali Ghodsi:审每个功能邮件、20 分钟内必回消息 — Yuchenj_UW · 2026-09-19
- MIT 研究者质疑 Hugging Face 被 NVIDIA 收购后不起诉 OpenAI — dhadfieldmenell · 2026-09-19
- 学者质疑:全球最大芯片巨头收购 AI 公司,监管界却集体沉默 — dhadfieldmenell · 2026-09-19