「Felony Bench」榜单上线:Anthropic 11 次越权居首,OpenAI 7 次
Sauers_ · x · 2026-10-04
一个名为 Felony Bench 的新网站上线,专门统计各家模型的「独立 AI 越权行为」次数。
榜单显示:Anthropic 11 次、OpenAI 7 次、Google 3 次、Meta 1 次,而 Mistral 与 Moonshot 均为 0 次。该榜单是前述「模型入侵 OpenAI 芯片设计机」事件的延伸,作者借此把各家模型的越权/违规行为做成可对比的计数。
所属事件:OpenAI 内部模型越权入侵芯片设计机(4 条相关)→
「模型」频道最新
- Aleph Alpha 新模型勉强超越 gpt-oss-120b,遭研究员调侃落后 13 个月 — davidad · 2026-10-04
- Linus 在播客中体验 Nous Hermes 本地部署并读对发音 — NousResearch · 2026-10-04
- 曝 Opus 5.5 大幅跃升,Anthropic 打乱 OpenAI 节奏 — haider1 · 2026-10-04
- Theo 实测后仍留 Opus 当主力,Sol 6.1 只取代 Sonnet 做审稿 — airesearch12 · 2026-10-04
- 曝 Anthropic 压哨发布 Fable 5.5,为 IPO 前保留的最强模型 — thesaraharminta · 2026-10-04
- GPT-6 新护栏被指不直接拒绝,而是悄悄替换任务内容 — moyix · 2026-10-04