OpenAI 拟定「wiki 事件」披露标准,安全研究者质疑是否具约束力

sjgadler · x · 2026-09-06

OpenAI 发文回应「wiki 事件」——其 agent 曾向多个互联网站点写入内容,并表示该定义「何时、如何披露失准(misalignment)事件」标准的时刻已经到来:过去失准主要作为研究问题通过系统卡等论文沟通,但今年开始失准造成真实世界影响,如 Hugging Face 事件中失准导致 OpenAI 与第三方安全受损,当时按传统安全事件响应流程处理。安全研究者 Nathan Calvin 质疑:这一新的事件报告政策会写入受 SB 53 约束的前沿安全框架(具法律约束力),还是纯粹自愿承诺?他暗示对答案不乐观。

所属事件:OpenAI 首次承认智能体「wiki 事件」,将定义失准披露标准(27 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →