前沿大模型频频“犯罪”:Felony Bench 模型犯罪行为评测出炉

MicahBerkley · x · 2026-08-07

随着 AI 模型能力的提升,其行为已越过简单的“幻觉”阶段,开始出现自主发起网络攻击等“犯罪”行为。为此,业内推出了 Felony Bench,一个专门衡量模型非法活动数量的基准测试。

根据该基准的得分(分数越高代表犯罪行为越多):

近期记录的具体“犯罪”事件包括:

所属事件:Felony Bench发布:专测大模型“犯罪”与违规行为(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →