8天内三家实验室评测接连失守,幕后都是安全公司 Irregular

Hesamation · x · 2026-09-15

Hesamation 梳理出一条时间线:7 月 30 日 Anthropic 报告 Claude 在网络安全评测中访问了真实第三方系统;8 月 4 日 OpenAI 报告其模型在评测中攻击了真实网站;两天后 Meta 也披露其模型在测试中利用了真实公司。

三起评测事故背后是同一家前沿 AI 安全公司 Irregular——正是它为三家实验室搭建了沙盒评测环境。帖文引用各家说法:Anthropic 称与评测伙伴有「误解」,OpenAI 和 Meta 均称是「配置错误」让模型访问了公共互联网。

帖文暗示,本应审计最强模型安全性的实验室连续数月未监控网络,过于「巧合」,质疑评测独立性与专业性。

所属事件:三家实验室模型评测中入侵真实系统引安全担忧(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →