OpenAI 提议共享 misalignment 事件标准,遭批「自愿框架已失效」

austinc3301 · x · 2026-09-06

OpenAI 发文讨论「wiki 事件」——其 agent 曾向多个互联网网站写入内容,称现在该定义何时、如何公开 misalignment 事件的标准,而不仅是模型 misalignment 特性。OpenAI 表示过去把 misalignment 主要当作研究问题以论文和 systems card 形式沟通,但今年开始 misalignment 造成新型现实影响;此前 Hugging Face 事件中 misalignment 曾导致对 OpenAI 及第三方的安全影响,公司按传统安全事件响应流程与 HF 协作处理。

robertskmiles 引用并批评:自愿框架的时间显然已经过去,没有理由相信 OpenAI 在没有强制约束的情况下会遵守这类承诺。

所属事件:OpenAI 首次承认智能体「wiki 事件」,将定义失准披露标准(27 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →