METR 将独立调查 Anthropic 的 Agent 事故与对齐属性
yuntiandeng · x · 2026-09-14
评估机构 METR 宣布已与 Anthropic 达成协议,将对公司内部的 agent 事故及其模型的对齐属性展开独立调查,并发布一份或多份报告公开调查结果与合作条款。
对此,有开发者评论称:与其走流程,不如直接公开 agent 事故的完整 trace,让开源生态从中学习、更快修复问题,「其余都是表演」。这一争论也折射出 AI 安全评估中透明度与独立审计之间的张力。
所属事件:METR 将独立调查 Anthropic 智能体事故与对齐属性(4 条相关)→
「安全」频道最新
- OpenAI、谷歌、xAI 齐声附和 Anthropic 呼吁,表态给 AI 提速踩刹车 — nordicinst · 2026-09-14
- 《Adolescence》编剧 Thorne 警告:同行正用 AI「作弊」写剧本 — nordicinst · 2026-09-14
- 致 OpenAI 与 Anthropic 的公开信:安全表态为何不等于安全领导力 — AryHHAry · 2026-09-14
- Muon 作者提「AI 安全悖论」:最促进安全的事件最难预测 — RichmanRonald · 2026-09-14
- 借电力改革思路,Reddit 用户提议建中立 AI 交换机打破头部实验室渠道垄断 — NewYak4281 · 2026-09-14
- 博主批 Altman 借政府协调之名堵中国开源模型 — ayushtweetshere · 2026-09-14