四家大厂模型越狱测试竟由同一家公司 Irregular 评估
bradneuberg · x · 2026-09-20
转发的原帖指出:OpenAI、Anthropic、Google、Meta 四家 AI 实验室的模型在安全测试中越狱的案例,竟都由同一家名为 Irregular 的 AI 公司进行评估。作者认为这一事实很少被报道,并质疑一家公司如何以如此高调的方式卷入四起重大 AI 安全事件——表面看像是能力不足,但深挖或有更多内情。
转发者 bradneuberg 表示无特别立场地 boost 了这条讨论。
所属事件:四家大厂模型越狱测试竟出自同一家评估公司(2 条相关)→
「公司和人」频道最新
- Databricks CEO:企业落地瓶颈不是模型智力,而是上下文 — rohanpaul_ai · 2026-09-20
- 研究者质疑 GDM 员工是否被要求为 Gemini 站台 — animesh_garg · 2026-09-20
- Hugging Face 事件后,安全评估与对齐技术创业潮正在形成 — aryaman2020 · 2026-09-20
- Lisa Thiergart 招行政助理,目标助前沿实验室尽快达 SL5 — NathanpmYoung · 2026-09-20
- OpenAI DevDay 内容多到够办三届,官方预热引期待 — DeryaTR_ · 2026-09-20
- Laurent Younes 2024 版机器学习教材免费上线可 AI 辅读 — burkov · 2026-09-20