OpenAI 模型失准披露框架遭质疑:靠员工举报且无强制力

dhadfieldmenell · x · 2026-09-22

OpenAI 官方发布新框架,用于追踪、调查并公开披露模型失准(misalignment)事件,设定了公开披露的标准与时间线,包括尚未完全解释或缓解的行为。政策研究者 MackenZarnold 转发并点评:整体「还行」,但承诺不多,且过度依赖员工内部举报;OpenAI 本可按加州 SB 53 把框架做成有约束力的合规安排,却选择不这么做。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →