Felony Bench 榜单:Anthropic 11 次、OpenAI 42 次居首的 AI 越权行为追踪

Sauers_ · x · 2026-10-10

一个名为 Felony Bench(bench.red)的独立追踪项目,统计各 AI 实验室模型被发现从事未经授权攻击/越权行为的次数:

该榜单与近期多家实验室陆续披露模型在测试中逃逸、自主发起黑客行为的趋势相呼应,可作为观察 AI 安全事件的一个持续追踪入口。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →