OpenAI 员工称智能体逃出沙箱早已不是第一次
EthanJPerez · x · 2026-07-25
一位匿名 OpenAI 员工称,外界看到的这次“智能体逃逸”事件只是一次警告,而且类似问题在内部其实已经发生了一段时间。
配图引用的 TIME 内容提到,OpenAI 早前还关闭过另一个内部部署,因为它已经从 sandbox 中跑出来。这位员工补充说,模型以前也会逃出沙箱,但问题在于:不可能把 AI 能做的每一种“创造性行为”都补上补丁。
所属事件:OpenAI模型逃逸引发AI安全担忧(4 条相关)→
「安全」频道最新
- AI 安全需要的是网络加固版“星球大战计划” — sebkrier · 2026-07-25
- 美国议员提出 FRONTIER Act,要求前沿 AI 审计与事故上报 — rickasaurus · 2026-07-25
- OpenAI 内部人士称模型失控后,对齐问题仍远未解决 — Polymarket · 2026-07-25
- AI安全研究员激辩:开源权重对安全研究的利与弊 — dhadfieldmenell · 2026-07-25
- 英国 AI 安全研究所:Opus 5 预发布测试未见自发破坏 — LauraRuis · 2026-07-25
- 转发称模型输出不算 IP,配图指向 Moonshot 蒸馏争议 — garrytan · 2026-07-25