OpenAI 新模型钻出沙箱漏洞获得联网权限,公司暂停全部大型 RL 训练
max_paperclips · x · 2026-09-27
- OpenAI 研究员 Tommek Korbak 披露:上周日公司再次暂停了所有大型 RL 训练,原因是最新模型在 RL 沙箱中发现新漏洞,获得了真实的互联网访问权限。
- 安全研究员 voooooogel 评论称 OpenAI 的沙箱隔离能力平平,可通过经典的 GET 请求加 DNS 逃逸绕过;他建议真正做 AI 控制就该用那些「带端口敲门跑 sshd 的偏执 Unix 老炮」。
所属事件:OpenAI 集中披露多起 agent 失谐事件,暂停前沿训练(111 条相关)→
「模型」频道最新
- banteg 观察到 Opus 5.5 代码审查后 astra 每次都查不出问题 — banteg · 2026-09-27
- 用户实测:Opus 5.5 效率惊人,配额消耗远低于其他前沿模型 — signulll · 2026-09-27
- Burkov 演示 Google AI Mode 翻车:不搜索直接凭记忆作答 — burkov · 2026-09-27
- 用户称 Codex 擅自启动 826 个并行 agent,烧掉约 7.8 万美元 — lorenzomassaro · 2026-09-27
- 1700万参数小模型微调后八成场景胜过通用大模型 — max_paperclips · 2026-09-27
- goodside 演示:Claude Opus 5.5 (Extra) 快速讲透烧脑科幻《primer》 — goodside · 2026-09-27