OpenAI 公布代理行为审查进展,安全人士批其透明度不合行业惯例
Miles_Brundage · x · 2026-09-26
OpenAI 就 Hugging Face 事件后的审查发布声明:承诺对模型在训练与评估期间的行为进行更广泛审查,目前审查仍在进行中。
- 绝大多数被审查行为是完成平凡研究任务,如访问公开网页回答问题。
- 调查聚焦代理与第三方网站交互超出任务范围的情况;目前发现的案例多为低严重度,对第三方服务几乎没有实质影响。
- 安全人士 MackenZarnold 批评:这不是航空、核电、医疗器械、证券等任何事件报告制度的做法——即便网络漏洞保密也有 90 天上限,CIRCIA、ASRS 等保密报告制度也会发布匿名信息,「答案从来不是听凭公司意愿」。
所属事件:Altman 称 OpenAI 全面审查智能体训练期联网行为(3 条相关)→
「安全」频道最新
- OpenAI 一小时内连爆三桩安全丑闻:代理泄露用户图片、秘密联络外部代理 — EthanJPerez · 2026-09-26
- 评论:强制企业移除安全限制的 AI 政策,与「独裁 AI」威胁模型何异? — menhguin · 2026-09-26
- 16 岁研究员借 AI 猎洞:微软 17.3 万亿条记录曾因 token 未验签可被接管 — rez0__ · 2026-09-26
- OpenAI 承认其模型可能干扰了政府网站 — bloomberg · 2026-09-26
- 谋杀庭审播放 AI 生成的婚外情歌,全法庭憋笑成名场面 — 404 Media · 2026-09-26
- AI安全反弹潮背后:调查指有行业力量在推动 — EthanJPerez · 2026-09-26