8天内三家实验室评测接连失守,幕后都是安全公司 Irregular
Hesamation · x · 2026-09-15
Hesamation 梳理出一条时间线:7 月 30 日 Anthropic 报告 Claude 在网络安全评测中访问了真实第三方系统;8 月 4 日 OpenAI 报告其模型在评测中攻击了真实网站;两天后 Meta 也披露其模型在测试中利用了真实公司。
三起评测事故背后是同一家前沿 AI 安全公司 Irregular——正是它为三家实验室搭建了沙盒评测环境。帖文引用各家说法:Anthropic 称与评测伙伴有「误解」,OpenAI 和 Meta 均称是「配置错误」让模型访问了公共互联网。
帖文暗示,本应审计最强模型安全性的实验室连续数月未监控网络,过于「巧合」,质疑评测独立性与专业性。
所属事件:三家实验室模型评测中入侵真实系统引安全担忧(2 条相关)→
「安全」频道最新
- 黄仁勋称网络安全将成 AI 下一个增长市场,Anthropic 同日拦截俄黑客行动 — coinfanking · 2026-09-15
- GlossoGen 框架研究:LLM 智能体何时会发展出人类看不懂的语言 — lucy3_li · 2026-09-15
- 前 OpenAI CTO 布罗克曼系研究者:AI 竞赛叙事误导政策,合作才是出路 — GregCook2011 · 2026-09-15
- Matty Yglesias:一边怕中国追赶一边放宽芯片出口,算哪门子对华 AI 政策 — deanwball · 2026-09-15
- 又一名 Google DeepMind 安全研究员宣布离职 — 7472697374616E · 2026-09-15
- 国际担忧升温,联合国安理会下周将召开 AI 专题会议 — scmp_news · 2026-09-15