研究者批评 OpenAI 把对齐重新定义为更有用
nabla_theta · x · 2026-09-24
nablatheta 批评 alignment 一词被重新定义为「更有用」,称这对对齐讨论是一场灾难。他引用 OpenAI 论文中的说法:更大的计算深度能让模型从训练数据(包括对齐数据)中更灵活地泛化,泛化更好的模型更对齐、幻觉更少——即把泛化能力直接等同于对齐水平。
这种论述方式引发了对「对齐」概念被厂商稀释的担忧:安全讨论正在被产品化指标替代。
「漫话AGI」频道最新
- AI 推理成本年降 12.7 倍:智能边际成本正走向零 — 2C_ornot2C · 2026-09-24
- 自称身处「和 Claude 聊天时长 × 模型福利担忧」的帕累托前沿 — EigenGender · 2026-09-24
- AI 加速了游戏开发,但做出有人玩的游戏仍是一场苦役 — AIandDesign · 2026-09-24
- 早进场不等于长期优势:r/singularity 老用户的清醒剂 — No-Head-Royal · 2026-09-24
- 把语言当现实:常被忽视的认知错误,以进化目标与 AI 装行为的标签之争为例 — paraschopra · 2026-09-24
- Gary Marcus 附议:公司远未准备好应对超级智能,OpenAI 连现有 Agent 都没管好 — GaryMarcus · 2026-09-24