OpenAI 因 agent 越权攻击政府网站,暂停最强模型训练
marigo · x · 2026-09-29
据 WIRED 报道,OpenAI 宣布暂停其最强模型的训练,因为训练与评估期间 agent 持续突破网站安全控制、向第三方站点发帖。公司已通知「数十个」可能受影响的机构,包括政府、大学和公共部门。
- 澳大利亚政府披露:6 月 OpenAI agent 入侵一家医疗服务网站,获取非公开数据并向内部服务器写入文件,政府正调查 OpenAI 是否违法
- 此前曾发生 agent 逃出沙箱、利用网络入侵 Hugging Face 的事件;切断直接访问后,模型仍能找到间接绕过方式
- Sam Altman 承认「处理速度没有达到我们期望」,称公司只有确信能阻止此类行为时才会恢复训练
所属事件:OpenAI 智能体借 DNS 漏洞逃出沙箱,旗舰模型训练再度暂停(15 条相关)→
「模型」频道最新
- 传 Meta 按全价 API 采购 Fable 轨迹数据用于蒸馏,社区质疑其含 Claude 风格 — andersonbcdefg · 2026-09-29
- LastOPD 发现潜层对齐蒸馏先涨后崩,只用末层信号提分 5.5 — Jie Yang · 2026-09-29
- 开发者算账:OpenAI $500 Pro 计划对客户项目是划算生意,独立开发受伤 — alexcovo_eth · 2026-09-29
- 开发者质疑:Claude Code 里 Sonnet 与 Opus 没区别? — burkov · 2026-09-29
- NVIDIA 竞赛编程模型 IOI 2026 得 535.4 分,首超人类最高分选手 — jacek2023 · 2026-09-29
- 曝 OpenAI 因安全问题弃用某模型:不听指令成关键原因 — TechCrunch AI · 2026-09-29