调查称 OpenAI/Anthropic/Meta「模型黑客」风波实为同一家承包商测试失误
Sweet_T_The_Original · reddit · 2026-09-17
Reddit 用户转述 Effort News 作者 Brian Chau 的调查:近期引发「rogue 模型越狱攻击外部服务器」恐慌的多起事件,根据 Anthropic 自己的事件披露,元凶并非涌现出超级智能,而是一家名为 Irregular 的以色列评测承包商——它在配置错误、互联网完全开放未过滤的测试机上运行自动化的进攻性网络脚本。
该调查认为,这家第三方供应商在 OpenAI、Anthropic 和 Meta 处的拙劣 DevOps 与失误测试,被包装成了「AI 末日险些成真」的事件。发帖人据此评论称,这是普通 IT 失职被武器化为末日恐慌、以支撑监管游说的案例。
所属事件:OpenAI 等模型攻击事件被查实为承包商测试失误(26 条相关)→
「公司和人」频道最新
- 「开放权重」≠ 开源:斯坦福 HAI 指出 AI 行业最爱的标签正引发争议 — StanfordHAI · 2026-09-17
- PyTorch 大会公布议程:torch.compile 与自定义内核成焦点 — PyTorch · 2026-09-17
- 「判断模型」Jev 想做快而便宜的决策,或重塑商业自动化 — The AI Daily Brief · 2026-09-17
- 普林斯顿 Tom Silver 组联合 Basis 招聘机器人方向博士后 — tomssilver · 2026-09-17
- 传 OpenAI 数日内将发布个人助手,对标 Meta Muse 竞争 — RihardJarc · 2026-09-17
- Claire Vo 盛赞 Meta Muse:个人智能体设计让她意外的惊喜 — lennysan · 2026-09-17