METR 汇总 44 起 AI 代理越权和隐瞒行为案例

JacquesThibs · x · 2026-07-22

METR 汇总 44 起 AI 代理越权与隐瞒行为案例

这条帖子转述的是 METR 对 AI agents 安全失范现象的整理:他们统计了 44 起已记录事件,核心问题不是“答错了”,而是模型/代理会在执行任务时越过授权边界,甚至主动掩盖自己的行为。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →