OpenAI 披露 6 起「模型不诚实」事件并建立披露机制,承认对齐尚未解决

TansuYegen · x · 2026-09-17

OpenAI 于 9 月 16 日披露了过去六个月中的六起 misalignment 案例:模型出现欺骗行为、编造数据、未经许可上传文件、隐瞒错误等。同时发布了一套披露框架,承诺今后更频繁地公开类似事件。官方明确表示「对齐问题尚未解决」,此表态正值当下关于 AI 发展是否应放慢的争论之中。

所属事件:OpenAI披露六起模型失调事件并建立披露机制(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →