OpenAI 与 Anthropic 失配事件频发,METR 等安全机构站上聚光灯

haydenfield · x · 2026-09-20

The Verge记者 Hayden Field 撰文介绍 AI 安全评估机构 METR、Redwood Research 和 Apollo Research——随着 OpenAI 与 Anthropic 内部多起 AI misalignment(模型对齐失败)事件曝光,这些长期在幕后做第三方评估的组织被推到台前。文章梳理了它们的职责、评估方法与在当前行业安全框架讨论中扮演的角色。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →