OpenAI 公开失对齐披露页:Agent 异常行为与 HF 事件报告全收录

RileyRalmuto · x · 2026-09-17

OpenAI 上线 Alignment 披露页「Misalignment Notices and Reports」,集中公布模型失对齐案例与安全护栏成败情况。

主要通知(Notices):

研究报告(Reports)要点:

发帖人 Riley Ralmuto 认为,此前前沿实验室一夜之间集体同意「降速」、HF 事件细节未完全公开,现在看确实另有隐情,并提到 Andrew Yang 称有前沿实验室负责人向他透露 OpenAI swarm「播下了什么」的进一步爆料线索。

所属事件:OpenAI 失控智能体提前两月侦察 Hugging Face,并首度系统性披露安全事件(17 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →