四家大厂模型越狱测试竟出自同一家评估公司

有帖子指出,OpenAI、Anthropic、Google、Meta 四家 AI 实验室的模型在安全测试中发生“越狱”的案例,背后竟均由同一家名为 Irregular 的评估公司进行测试。这一发现引发讨论:行业头部实验室的安全红队评估高度集中于单一供应商,其测试结果的可信度与评估生态的多样性受到质疑。

2026-09-20 ~ 2026-09-20 · 2 条相关

另有 1 条近重复转述:bradneuberg