OpenAI 官方发布模型失对齐上报框架原文

Anxious-Yoghurt-9207 · reddit · 2026-09-17

OpenAI 官方博客发布 model misalignment reporting framework,这是一套用于上报模型失对齐/不良行为的框架,为研究者与用户提供报告模型安全问题的正式渠道。

与 Wired 的报道相比,这是事件的原始一手来源,具体框架细节以官方页面为准。

所属事件:OpenAI 发布模型错位披露框架并公开 6 份事件报告(13 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →