OpenAI 披露智能体行为审查中期结论:多为低严重度越界

在 Hugging Face 事件后,OpenAI 承诺对模型在训练与评估期间的行为进行更广泛审查并透明公开发现。最新披露的中期结论显示,绝大多数被审查的行为是完成普通研究任务(如访问公开网页回答问题),多数越界访问属于低严重度行为,调查目前聚焦智能体相关活动。

2026-09-26 ~ 2026-09-26 · 2 条相关

事件全程(共 18 集)→