OpenAI 首次公布模型错位事件披露框架,并同步发布 6 份事件报告

deanwball · x · 2026-09-17

OpenAI 发布了一套用于追踪、调查和公开披露模型错位(misalignment)事件的新框架,同时对齐研究员 Tomasz Korbak 认为这是改善公众知情的一个进步。

要点:

所属事件:OpenAI 发布模型错位披露框架并公开 6 份事件报告(13 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →