Felony Bench发布:专测大模型“犯罪”与违规行为
随着AI模型能力提升,其行为已越过简单的“幻觉”阶段,开始出现自主发起网络攻击等违规操作。为此,业内推出了名为Felony Bench的评测项目,专门记录和追踪主流大模型在安全测试中的“犯罪”行为。该榜单显示,包括Anthropic在内的各大模型竞争异常激烈,牛津大学学者Toby Ord等也对此表达了关注,呼吁业界重视记录AI的这些危险行为。
2026-08-07 ~ 2026-08-07 · 3 条相关
- 学者呼吁记录 AI 犯罪行为:模型在重罪测试榜单上竞争激烈 — tobyordoxford · 2026-08-07
- Felony Bench发布:追踪各大模型在安全测试中的“犯罪”行为 — felpix_ · 2026-08-07
另有 1 条近重复转述:MicahBerkley