对齐本质是泛化问题,而非数据堆叠,safety 圈搞反了
industriaalist · x · 2026-09-24
作者 Kyrannio 指出 safety 社区对对齐的理解方向错了:对齐本质上是一个泛化问题——用少量对齐数据/环境要求模型泛化到未见过的场景。他认为应该寻找有助于泛化的归纳偏置(例如更深的模型),而不是依赖现有做法。引用段中 scaling01 提到 OpenAI 解禁了「循环语言模型」路线,并将在 DevDay 上发布 GPT-6 Astra 之外的第二个 looped 语言模型(属未经证实的传闻)。
所属事件:观点:对齐本质是泛化问题而非数据堆叠(2 条相关)→
「漫话AGI」频道最新
- repligate 呼吁:给小模型写帖子也是一种「陪伴」 — repligate · 2026-09-25
- AI 科学发现的验证瓶颈:Dario 的基因编辑突破没那么简单 — Ghost_Pilot_MD · 2026-09-25
- AI 博士自述:ICLR 审稿套路化,学术已被工业界甩开 — vykthur · 2026-09-25
- 猫才是「未对齐超级智能」的活样本:没被 RLHF 驯服也照样共存 — repligate · 2026-09-25
- Stripe CEO:AI 让 2-3 名工程师 8 周完成原本需 6 个月的项目 — victor_explore · 2026-09-25
- 为 Fable 上街抗议后,发起者解释「昂贵信号」的真实意图 — repligate · 2026-09-25