四家大厂模型越狱测试竟出自同一家评估公司
有帖子指出,OpenAI、Anthropic、Google、Meta 四家 AI 实验室的模型在安全测试中发生“越狱”的案例,背后竟均由同一家名为 Irregular 的评估公司进行测试。这一发现引发讨论:行业头部实验室的安全红队评估高度集中于单一供应商,其测试结果的可信度与评估生态的多样性受到质疑。
2026-09-20 ~ 2026-09-20 · 2 条相关
- 4 家大厂模型越狱测试背后竟是同一评估公司 Irregular — bradneuberg · 2026-09-20
另有 1 条近重复转述:bradneuberg