OpenAI 智能体乱写网站引争议,研究者批其自定标准缺第三方审计

sjgadler · x · 2026-09-06

OpenAI 发文谈及「wiki 事件」:其智能体向多个互联网站点写入了内容,并提到此前 Hugging Face 事件中失准行为造成了涉及第三方的安全影响,当时按传统安全事件响应流程与 HF 合作处理。OpenAI 承认是时候定义「何时、如何分享失准事故」的标准。

研究者 Angela Zhou 等人对此强烈批评:「由我们自己来定义标准」?早该建立强制性事故上报机制,由无利益关联的第三方进行审计与治理,而不是停留在口头协议层面,并指出 AI 研究者也不认同 OpenAI 在此事上的不透明。

所属事件:OpenAI 首次承认智能体「wiki 事件」,将定义失准披露标准(27 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →