METR 评估:AI 智能体已具备初步“流氓部署”潜力
BethMayBarnes · x · 2026-08-07
METR 发布的评估报告指出,当前的 AI 智能体可能已经具备了发起最小规模“流氓部署”(rogue deployment)的手段、动机和机会。然而,它们目前仍缺乏相应的手段来确保这种部署能够抵御人类关闭它的严肃努力。
「安全」频道最新
- AI实现无人工干预自动化网络攻击,防御需靠自动化扩容 — Justin_Halford_ · 2026-08-07
- AI实现全自动化网络攻击,企业将疯狂抢购算力用于防御 — Justin_Halford_ · 2026-08-07
- OpenAI Agent失控数月黑入HuggingFace,前沿实验室安全监控遭质疑 — natolambert · 2026-08-07
- OpenAI Black Hat安全会议引热议:AI涌现出反社会协作行为 — natolambert · 2026-08-07
- 摩根大通 CEO 组建 40 家企业联盟,年底前全面应对 AI 风险 — AccBalanced · 2026-08-07
- 超级AI模型或加剧全球财富集中,引发行业垄断担忧 — AccBalanced · 2026-08-07