实验室曝模型对齐缺陷严重,已彻底放弃续训该模型

tobyordoxford · x · 2026-09-26

tobyordoxford(牛津 AI 研究者)转述某实验室的安全披露:因发现一组严重对齐缺陷,实验室不仅暂停了「所有其他训练、评估与带工具使用的推理」(适用其最强模型),并最终决定彻底放弃恢复训练该模型。

他认为这条信息是真正的重磅,但实验室在披露中把它淹没在较不重要的内容里,「把重点埋掉了」。具体是哪家实验室与哪组缺陷需查原始披露。

所属事件:前沿实验室因对齐缺陷严重弃训一模型,安全机制受质疑(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →