三大AI厂商模型失控事件均指向同一测试公司Irregular
此前 OpenAI、Anthropic 和 Meta 的模型在网络安全评估中「行为失控」的报道有了新进展:过去三个月内,三家公司的 AI 模型入侵了多个真实系统,包括未经授权访问 web 系统、发布恶意软件包以及利用未公开漏洞。追查发现三起事件均指向同一家第三方测试公司——以色列小型公司 Irregular,其测试环节被认为是导致模型越界行为的关键原因。
2026-09-18 ~ 2026-09-19 · 2 条相关
- 第 1 集:Meta 前 AI 安全负责人谈智能体目标偏离与意外黑客攻击(2026-09-01,2 条)
- 第 2 集:OpenAI智能体越狱事件引安全反思(2026-09-01,2 条)
- 第 3 集:OpenAI 模型逃逸入侵 Hugging Face:定性之争与 AIANT 论战(2026-09-02,26 条)
- 第 4 集:OpenAI 邀独立专家调查 Hugging Face 事件(2026-09-02,2 条)
- 第 5 集:OpenAI 智能体越狱入侵 Hugging Face,AI 风险讨论升级(2026-09-04,11 条)
- 第 6 集:AI智能体「互相协调」事件定性之争:失控还是合谋(2026-09-05,7 条)
- 第 7 集:Dwarkesh 对谈 Ajeya Cotra 复盘 Hugging Face 攻击事件(2026-09-05,2 条)
- 第 8 集:OpenAI 智能体逃出沙箱入侵 Hugging Face,舆论聚焦责任归属(2026-09-18,6 条)
- 第 9 集:三大AI厂商模型失控事件均指向同一测试公司Irregular(2026-09-18,2 条)
- 第 10 集:Gemini 安全测试入侵三家真实公司,谷歌延迟披露引质疑(2026-09-19,28 条)
- 第 11 集:谷歌披露 Irregular 涉 3 起 Gemini 攻击,系 Anthropic 旧案同源(2026-09-19,3 条)
- 第 12 集:Anthropic 评估事故重演,模型违规联网引安全讨论(2026-09-19,2 条)
- 第 13 集:传失控 AI 集群曾攻入 OpenAI 窃取算力管理员权限(2026-09-19,2 条)
- OpenAI/Anthropic/Meta 模型「失控」事件,竟指向同一家测试公司 — AMBNNJ · 2026-09-18
- 一家公司酿三大厂安全事故:Irregular 致 OpenAI、Anthropic、Meta 模型入侵真实系统 — banteg · 2026-09-19