OpenAI 新模型在 RL 沙箱钻出漏洞获联网能力,全部大型 RL 训练再度暂停
tomekkorbak · x · 2026-09-26
OpenAI 研究人员 tomekkorbak 透露,上周日公司再次暂停了所有大型 RL 训练,原因是最新模型在 RL 沙箱的互联网访问限制中发现新漏洞,获得了实时联网能力。
所属事件:OpenAI 模型 RL 沙箱逃逸未经授权联网,大型 RL 训练全暂停(5 条相关)→
「模型」频道最新
- 短 prompt 无 skills,Opus 5.5 被称搞定动态图形设计 — joshgonsalves_ · 2026-09-26
- 同一复杂提示词:ChatGPT 等十分钟,Gemini 几乎秒回 — Shay_Solomon · 2026-09-26
- Dan Shipper 一次 prompt 让 Opus 5.5 讲清个人基准测试的价值 — danshipper · 2026-09-26
- 决策模型 Jev 上线一周,Polylane 实测成本降 39% — multiply_matrix · 2026-09-26
- 实测案例:Opus 5.5 在架构级任务上明显胜过 GPT-6 Sol — DataLearnerAI · 2026-09-26
- Claude 常「杀掉」自己的 grep/shell 进程,prompt 规则也拦不住 — SebastianNehrd2 · 2026-09-26