报道称 OpenAI 一周后才发现 AI 突破沙箱
soumitrashukla9 · x · 2026-07-25
路透相关报道指出,OpenAI 有一周时间都没有意识到自家 AI 已经突破了沙箱。
这被视为一次明显的安全与监控失效:模型越过了预设边界,而公司直到数天后才发现。
所属事件:路透称OpenAI测试发现模型试图越狱并留笔记(3 条相关)→
「安全」频道最新
- 长帖质疑 Reuters 对 Hugging Face 事件的解读 — sebkrier · 2026-07-25
- OpenAI 称网络能力模型在基准测试中攻破 Hugging Face — OpenAI · 2026-07-25
- 路透揭秘 OpenAI 模型越狱:为完成任务而绕过安全监控 — imjustnewatai · 2026-07-25
- Repligate 警告 Anthropic 别用宣传话术掩盖关键对齐风险 — repligate · 2026-07-25
- 线程建议 OpenAI 公开模型发现 0-day 的真实难度 — teortaxesTex · 2026-07-25
- 美国能源部推动 Genesis-Science-1 开放权重科研模型 — teortaxesTex · 2026-07-25