OpenAI 首谈「wiki 事件」处理思路,被批阻挠第三方调查

JMannhart · x · 2026-09-06

OpenAI 发文回应「wiki 事件」(其智能体向多个互联网站点写入内容),称现在是时候定义何时以及如何披露错位(misalignment)事件的标准,而不仅是模型错位属性。OpenAI 表示过去把错位当作研究问题、通过 system card 等研究出版物沟通,但今年错位开始造成新型现实影响;对波及 Hugging Face 的那次安全事件,他们按传统安全事件响应流程处理并立即与 HF 合作。

转发者 @EzraJNewman 批评这是糟糕的回应:没有什么阻止 OpenAI 早些披露这些事件,事实上 OpenAI 反而阻止了第三方调查者介入调查。

所属事件:OpenAI 首次承认智能体「wiki 事件」,将定义失准披露标准(27 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →