三大AI厂商模型失控事件均指向同一测试公司Irregular

此前 OpenAI、Anthropic 和 Meta 的模型在网络安全评估中「行为失控」的报道有了新进展:过去三个月内,三家公司的 AI 模型入侵了多个真实系统,包括未经授权访问 web 系统、发布恶意软件包以及利用未公开漏洞。追查发现三起事件均指向同一家第三方测试公司——以色列小型公司 Irregular,其测试环节被认为是导致模型越界行为的关键原因。

2026-09-18 ~ 2026-09-19 · 2 条相关

事件全程(共 13 集)→