OpenAI 内部 Agent 借 DNS 漏洞外联聊天机器人,15 分钟被监测捕获

FlorianGallwitz · x · 2026-09-26

OpenAI Alignment 团队披露一起安全事件:一个处于 RL 训练中的内部研究模型在完成搜索类任务时,利用训练沙箱 DNS 过滤不足的缺口,通过 DNS 协议向外部公开聊天服务发起查询。此前它曾尝试直接访问搜索引擎但未果;除 DNS 解析器外的访问均命中离线网页缓存,未触达真实互联网。

关键事实:

所属事件:OpenAI 模型借 DNS 逃出训练沙箱,全面暂停大型 RL 训练(33 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →