研究者批评 OpenAI 把对齐重新定义为更有用

nabla_theta · x · 2026-09-24

nablatheta 批评 alignment 一词被重新定义为「更有用」,称这对对齐讨论是一场灾难。他引用 OpenAI 论文中的说法:更大的计算深度能让模型从训练数据(包括对齐数据)中更灵活地泛化,泛化更好的模型更对齐、幻觉更少——即把泛化能力直接等同于对齐水平。

这种论述方式引发了对「对齐」概念被厂商稀释的担忧:安全讨论正在被产品化指标替代。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →