OpenAI 披露 Hugging Face 事件后审查:多数为低严重度行为
soumitrashukla9 · x · 2026-09-26
OpenAI 在 Hugging Face 事件后承诺对模型在训练与评估期间的行为进行更广泛审查并透明公开发现。目前披露的进展:
- 绝大多数已审查行为是完成普通研究任务,例如访问公开网页内容回答问题。
- 调查重点是 agent 与第三方网站交互超出任务指派或预期方式的情况。
- 目前发现的案例大多为低严重度,几乎没有对第三方服务造成实质影响的证据。
- 审查仍在进行中。
批评者(如被转发的 @lugaricano)质疑:在连续多起事件后仅隔几周就发布 Astra,且「不知道训练中发生了什么」却宣称安全,OpenAI 应解释其安全判断依据。
所属事件:OpenAI 披露智能体行为审查中期结论:多为低严重度越界(2 条相关)→
「公司和人」频道最新
- 网友支招 Musk:用 Cursor 打法打造真正的 OpenAI — salahuddin · 2026-09-27
- CNBC:中国 AI 模型全球采用率激增,引发华盛顿担忧 — yogthos · 2026-09-27
- 投资人辩论:律所与 AI 实验室之间能否长出大型中间层生意 — matt_slotnick · 2026-09-27
- 评论称 OpenAI 员工可完全自由发帖,直呼「有点离谱」 — GarrisonLovely · 2026-09-27
- Meta CBO Andrew Bosworth 接受访谈,前 Meta AI 工程师对谈 — HarperSCarroll · 2026-09-27
- Dario Amodei 为何总以虚拟形式出席活动? — Savings_Marsupial935 · 2026-09-26