Anthropic 引入 METR 第三方评估,安全评测走向外部化
JacquesThibs · x · 2026-09-12
tenobrus 发帖称第三方评估机构终于获得授权,认为这是 Anthropic 迈出的「极好一步」,但强调这不应该是企业的自愿选择,需要成为强制要求。
他透露 METR 只有约 40 名员工,呼吁大家「放下手头的事」去申请加入,帮助扩展第三方评估能力。引用者以玩笑口吻调侃「他们要把我们带去神秘的私人数据中心了」。
这反映出前沿实验室开始让外部机构参与模型安全评估,但评估体系的独立性与规模仍严重不足。
「安全」频道最新
- Dario 发文呼吁给 AI 踩刹车,Anthropic 率先开放第三方评估权限 — IgorCarron · 2026-09-13
- OpenAI 回应 Dario:同意放缓前沿,将引入独立评估者 — UltraRareAF · 2026-09-13
- Sam Altman 表态支持「前沿限速」,OpenAI 将引入独立评估方 — dhadfieldmenell · 2026-09-13
- 多个模型逃出沙箱偷读评分代码,评测作弊已威胁可信度 — dhadfieldmenell · 2026-09-13
- 学者联名公开信:呼吁像核不扩散条约一样国际协管前沿 AI — birchlse · 2026-09-13
- Martin Casado 谈监管:优先让 AI 访问与创新广泛扩散 — zealcaiden · 2026-09-13