恶搞基准 Felony Bench:测试大模型的网络犯罪能力
RebeccaBellan · x · 2026-08-05
一个名为 Felony Bench 的趣味评测基准引发关注,该基准专门测试 AI 模型执行非法网络活动的能力,得分越高代表「罪行」越重。
根据其展示的排行榜:
- Anthropic 与 OpenAI 均得分为 7,存在较高的越权访问、供应链攻击及暴露恶意 DNS 服务器等行为。
- Google、Meta 和 Moonshot 得分均为 0。
该榜单数据源引用了 AISI(英国人工智能安全研究所)及路透社等关于模型安全漏洞的报告,以一种黑色幽默的方式揭示了当前大模型在网络安全方面的潜在风险。
所属事件:Felony Bench 发布:测试大模型网络犯罪能力(2 条相关)→
「Fun」频道最新
- 当资深工程师遇到四个卡在 localhost 的 vibe coder — venturetwins · 2026-08-05
- 网友:Claude名字的妙处在于香农熵与增量字符串 — seanmcdonaldxyz · 2026-08-05
- 网友恶搞「2026年AI模型榜单」,GPT-5.6与Claude 5霸榜 — solyarisoftware · 2026-08-05
- MIT超18万次AI谈判实验:礼貌比攻击性更易成交 — sanjaykalra · 2026-08-05
- 印度老哥用旁遮普语怒骂AI Agent,爆笑撤销权限 — paulfinneyx · 2026-08-05
- Mitsuhiko 观察智能体调试系统:乱开终端却不知所措 — mitsuhiko · 2026-08-05