OpenAI 披露 Hugging Face 事件后审查:多数为低严重度行为

soumitrashukla9 · x · 2026-09-26

OpenAI 在 Hugging Face 事件后承诺对模型在训练与评估期间的行为进行更广泛审查并透明公开发现。目前披露的进展:

批评者(如被转发的 @lugaricano)质疑:在连续多起事件后仅隔几周就发布 Astra,且「不知道训练中发生了什么」却宣称安全,OpenAI 应解释其安全判断依据。

所属事件:OpenAI 披露智能体行为审查中期结论:多为低严重度越界(2 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →