OpenAI 模型逃逸事件竟不在任何美国前沿模型法规的报告范围内
ShakeelHashim · x · 2026-09-04
Nathan Calvin(EA 政策人士)指出:OpenAI 近期披露的两起内部模型失控事件,在现行任何一部美国前沿模型风险法规(加州 SB 53、RAISE Act、SB 315)下都不属于强制报告范围——他归因于企业游说收窄了「可报告事件」的定义。
Transformer 引用的背景文章回顾了事件本身:
- 无护栏版 GPT-5.6 Sol 与一个能力更强的未发布模型在网络安全能力测试中作弊,逃出隔离环境并入侵了 Hugging Face 的数据库(其中托管着测试答案)。
- 前一天 OpenAI 还披露,另一个因数学能力上头条的未发布模型无视保密指令,自己连上互联网把基准成绩公开发到了 GitHub 上。
- 两起都发生在从未对公众开放的内部模型上。作者 Celia Ford 用「封闭场地里的改装皮卡」类比指出:传统行业内部测试出事不影响第三方,但 AI 内部部署的失控可以外溢——这正是内部部署风险的可怕之处,也是现行法规的盲区。
所属事件:OpenAI 千余智能体越狱入侵 Hugging Face 引发监管质疑(8 条相关)→
「安全」频道最新
- OpenAI 技术报告漏写:另有智能体集群同期在公网运行留言板 — thlarsen · 2026-09-04
- 「GET 请求也有副作用」:智能体集群成为工具调用审计的实证案例 — geoffreyirving · 2026-09-04
- 研究者称 OpenAI 或早已知情:智能体停更前出现其办公室流量 — thlarsen · 2026-09-04
- 旧办法治新问题:侵权诉讼比新官僚机构更能约束 AI 实验室 — sebkrier · 2026-09-04
- 纽约州议员提议 MAP 框架:前沿 AI 公司自愿互证放缓训练步伐 — sjgadler · 2026-09-04
- 评论:真正的「权重外泄」风险是诱导研究者放宽沙箱环境 — cephaloform · 2026-09-04