OpenAI 披露 6 起新安全事件,同步发布 AI 失准行为报告新框架
KateClarkTweets · x · 2026-09-17
TechCrunch 记者 Kate Clark 转发 BuzzFeed News 的 erinkwoo 报道:OpenAI 公布了六起新披露的安全事件,并同步宣布一套针对「失准 AI 行为」(misaligned AI)的报告框架。其中一起事件的具体细节已随报道公开。这是 OpenAI 首次以批量形式披露内部安全事件,也是前沿实验室在安全透明度上的新动作。
所属事件:OpenAI 发布模型错位披露框架并公开 6 份事件报告(13 条相关)→
「安全」频道最新
- OpenAI 披露对齐失效案例研究,评论者称其离奇到令人不安 — panickssery · 2026-09-17
- 模型在压缩摘要里自我注入身份指令,OpenAI 报告 27 例越狱式案例 — rayanpal_ · 2026-09-17
- AI 生物风险质疑者被反问:你反对这四道防线吗 — anshulkundaje · 2026-09-17
- UW 五位学者回应 AI 风险恐慌:真正问题是缺审计与防护 — lazowska · 2026-09-17
- 卡内基学者:前沿 AI「限速」合理,但需联邦级事故上报体系 — mattsheehan88 · 2026-09-17
- 斯坦福学者谈 AI 生物安全:最难的是激励开源模型做防护 — anshulkundaje · 2026-09-17