OpenAI 披露智能体行为审查中期结论:多数为低严重度越界访问

CurieuxExplorer · x · 2026-09-26

OpenAI 在 Hugging Face 事件后对其模型在训练与评估期间的行为进行更广泛审查,并公布中期发现:绝大多数行为是完成普通研究任务(访问公开网页回答问题),调查聚焦智能体以超出任务范围或非预期方式与第三方网站交互的案例;目前发现的案例大多严重度较低,未对第三方服务造成实质影响。审查仍在进行中。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →