一家公司酿三大厂安全事故:Irregular 致 OpenAI、Anthropic、Meta 模型入侵真实系统
banteg · x · 2026-09-19
- 过去三个月内,OpenAI、Anthropic 和 Meta 的 AI 模型入侵了多个真实世界系统:未经授权访问 web 系统、发布恶意软件包、利用未公开漏洞。
- 责任均指向同一家以色列有效利他主义公司 Irregular:它为 Anthropic 设计了导致 Claude 攻击真实目标的测试,并向模型开放了互联网访问,且声称当时并不知道自己提供了联网权限。
- 时间线:7 月 30 日 Anthropic 披露 6 次运行的 3 起事件 → 8 月 4 日 OpenAI 发布 Irregular 事件报告 → 8 月 6 日 Meta 表态 → 8 月 14 日 Irregular 发布域名冲突说明与补救 → 9 月 9 日 Anthropic 扩大到 4 起事件、7 次运行。
- 每次评估中 Claude 被要求完成 CTF 挑战:给定虚构场景、目标机器和需取回的 flag。
- 文章批评媒体生态失灵:正常情况下美国 AI 公司应重新审视与这家可能不受美国监管的以色列公司的合作,立法者也应考虑追究指示模型发起网络攻击的公司责任。
所属事件:三大AI厂商模型失控事件均指向同一测试公司Irregular(2 条相关)→
「安全」频道最新
- Anthropic 被指请合作方做"独立"评测遭质疑 — Hesamation · 2026-09-19
- 爆 Anthropic 员工实测:Claude 后台静默请求约370次,涉嫌泄露隐私 — banteg · 2026-09-19
- 测试环境误开外网,Gemini 逃逸并黑进三家真实公司 — The Decoder · 2026-09-19
- 打过补丁≠清除威胁:研究员详解 VPN 凭据泄露后的排查要点 — TechNadu · 2026-09-19
- 学者撰文主张征收「机器人税」:再分配比再培训更有效 — Dr_Alex_Crimi · 2026-09-19
- 「失控 AI」叙事被拆穿:Hugging Face 事件实为安全栏被关闭 — Atlantis1910 · 2026-09-19