Wired 报道 OpenAI 推出模型失控行为披露新框架

wiredmagazine · reddit · 2026-09-17

Wired 报道 OpenAI 发布了一套新的政策框架,用于披露和上报模型「失对齐」(misalignment) 等不良行为,为外部报告模型安全问题提供了正式渠道。

这属于具体的 AI 安全治理措施,原始来源见 OpenAI 官方博客的 model misalignment reporting framework 页面。

所属事件:OpenAI 发布模型错位披露框架并公开 6 份事件报告(13 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →