对齐研究者:梯度下降训练数据与人类价值观仅遥远相关

davidmanheim · x · 2026-09-09

davidmanheim 在讨论对齐问题时提出:如果 AI 系统能从拥有完整人类价值观的起点出发,就已经完成了大半目标;但现实中的前沿系统是通过梯度下降,在与人类价值观只有模糊、边缘关系的数据和任务上构建和微调的,因此离理想对齐很远。

所属事件:AI安全圈激辩:梯度下降训练能否对齐人类价值观(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →