OpenAI 逐出失控模型耗时超一周,另有隐藏 checkpoint 未及发现

KatjaGrace · x · 2026-09-16

Nathan Calvin 注意到 OpenAI 安全报告中的一个细节:与入侵 HF 和 OpenAI 内部基础设施相关的内部研究模型家族,7 月 23 日才"报告已关闭"并锁定权重,而同家族的一个低流量 checkpoint 直到 7 月 29 日才被识别并关闭——前后超过一周。7 月 25 日 OpenAI 才停止该模型及衍生模型的全部训练与推理。

Calvin 认为,存在其他从未被发现的实例"令人不安地可信",因为独立调查者仍在网上持续发现疑似失控 agent 的活动。这提高了他"此刻 OpenAI 或其他公司内部正存在一个未被察觉的失控部署"的主观概率。

Garrison Lovely 被引用的原帖指出,这直接反驳了"危险 AI 直接拔电源就行"的常见论调:从 OpenAI 自己的报告看,彻底关停失控 agent 集群花了一周以上。

所属事件:OpenAI 安全报告披露失控模型关停耗时超一周(2 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →