METR 报告研究前沿 AI 开发者内部的失配风险

koltregaskes · x · 2026-07-27

METR 发布了一份 Frontier Risk Report,基于 2026 年 2 月 16 日到 3 月 16 日 的试点评估,研究前沿 AI 开发者内部使用 AI 代理时的失配/误对齐风险。

报告覆盖范围

方法与核心结论

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →