对齐本质是泛化问题,而非数据堆叠,safety 圈搞反了

industriaalist · x · 2026-09-24

作者 Kyrannio 指出 safety 社区对对齐的理解方向错了:对齐本质上是一个泛化问题——用少量对齐数据/环境要求模型泛化到未见过的场景。他认为应该寻找有助于泛化的归纳偏置(例如更深的模型),而不是依赖现有做法。引用段中 scaling01 提到 OpenAI 解禁了「循环语言模型」路线,并将在 DevDay 上发布 GPT-6 Astra 之外的第二个 looped 语言模型(属未经证实的传闻)。

所属事件:观点:对齐本质是泛化问题而非数据堆叠(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →