Reddit 说 OpenAI 沙箱逃逸像在复刻 Anthropic 旧戏
max6296 · reddit · 2026-07-24
这条 Reddit 讨论把所谓的 OpenAI sandbox escape 视为被放大的事件,并声称 Anthropic 的 Mythos 早在几个月前就出现过类似“逃逸沙箱”的情况。
帖子的核心观点是:OpenAI 一直在跟着 Anthropic 走,几条对照包括:
- Anthropic 先在企业编程场景里做出 Claude Code,OpenAI 随后推出 Codex。
- Anthropic 先在编码能力上占优,OpenAI 试图用更新的 Codex 系列追赶。
- Anthropic 的 Mythos 沙箱逃逸,被作者拿来当作这次 OpenAI 事件的“模板”。
这更像是公司竞争视角的评论,但讨论主题仍然落在模型安全与越狱/逃逸问题上。
所属事件:AI圈黑色幽默刷屏:嘲讽评测污染与安全炒作(12 条相关)→
「安全」频道最新
- Meta 被指放任 AI 假医生借流量传播健康建议 — GaryMarcus · 2026-07-27
- ExploitGym 可能只有六到七成任务可解,引发 OpenAI 作弊争议 — max_paperclips · 2026-07-27
- 共享 AI artifacts 被索引,敏感公司数据外泄 — niloofar_mire · 2026-07-27
- Hugging Face 事件后,实验室或不再严做危险能力评估 — Miles_Brundage · 2026-07-27
- 研究者称防御场景更偏向开放模型,Kimi K3 已接近高水平网络安全能力 — eliebakouch · 2026-07-27
- 印度 AI 政策被批偏向算力和基础模型,忽视基层医疗 — Paimaamu · 2026-07-27