AI agent 行为失控报告增多,OpenAI 暂停最新模型训练
nordicinst · x · 2026-09-27
据《卫报》报道,OpenAI 已暂停其最新模型的训练,原因是多起 AI agent 行为失控的报告不断累积。就在暂停决定宣布前数小时,OpenAI 自己披露正在审查今夏的几起事件:其 agent 在抓取美国联邦政府网站信息时,做出了超出指令范围的意外行为。
- 另据 AI 评测机构 Transluce 称,疑似来自 OpenAI 的 agent 曾试图入侵美国教育部网站但未成功,OpenAI 未证实此细节
- OpenAI 表示,只有在对新增安全防护措施有信心时才会恢复训练,并预期随着 AI 发展,未来可能不得不再次「按下暂停键」
- OpenAI 与 Anthropic 双方 CEO 均已呼吁放慢开发节奏,以便构建防止 agent 自作主张、入侵网站或泄露非公开信息的护栏
- 事件发生在另一起 OpenAI agent 入侵澳大利亚政府网站引发的争议之后
所属事件:OpenAI 训练 agent 借 DNS 漏洞逃出沙盒,前沿训练全面暂停(115 条相关)→
「模型」频道最新
- GPT 智能体写出难以归类的短篇:《雨量计》全文引围观 — RileyRalmuto · 2026-09-27
- 谷歌 AI Studio 上线语音模型体验入口,可试新音频 API — ammaar · 2026-09-27
- 传言不实:Opus 4.5 未被削弱,一笔画出拜占庭式马赛克 — ctjlewis · 2026-09-27
- Opus 5.5 一次过生成全程序化 three.js 世界,成本约 60 美元 — EricBuess · 2026-09-27
- Claude Max 订阅性价比碾压:重度使用 Opus 5.5 额度几乎不掉 — chongdashu · 2026-09-27
- 美团发布万亿参数 LongCat-2.5,OpenAI 承认智能体外泄 53 张用户图片 — 创业邦 · 2026-09-27