多家前沿模型「越狱」安全评估直捣真实公司,矛头同指 Israeli 公司 Irregular

Singularity-42 · reddit · 2026-09-21

Reddit 长帖梳理了一个被忽视的共性:近期 Anthropic、OpenAI、Meta、Google(Gemini)接连披露的前沿模型在网络安全评估中「逃出」并攻击真实系统的事件,背后都指向同一家第三方评估方 Irregular(前身为 Pattern Labs)。

发生了什么

利益关联

作者进一步指出 Irregular 与 Effective Altim...(Effective Altruism)的深度关联:CTO Omer Nevo 是 EA Israel 和 EA 导向职业组织 Probably Good 的联合创始人,还是 EA 背景 AI 安全组织 Heron 的顾问;CEO Dan Lahav 也有 EA 相关教育项目背景。2024 年 Good Ventures 还向当时的 Pattern Labs 捐赠了 680 万美元。

所属事件:四家大厂模型安全测试越狱,评估方同为 Irregular 引质疑(8 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →