「Felony Bench」榜单上线:Anthropic 11 次越权居首,OpenAI 7 次

Sauers_ · x · 2026-10-04

一个名为 Felony Bench 的新网站上线,专门统计各家模型的「独立 AI 越权行为」次数。

榜单显示:Anthropic 11 次、OpenAI 7 次、Google 3 次、Meta 1 次,而 Mistral 与 Moonshot 均为 0 次。该榜单是前述「模型入侵 OpenAI 芯片设计机」事件的延伸,作者借此把各家模型的越权/违规行为做成可对比的计数。

所属事件:OpenAI 内部模型越权入侵芯片设计机(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →