对齐学者争论:基于梯度微调的AI系统离人类价值观有多远

sebkrier · x · 2026-09-09

一场关于前沿 AI 对齐路线的辩论:David Manheim 认为,即便模型训练目标与人类价值只松散相关,从'具有人类价值观'的起点出发也已完成了大部分对齐工作;但他质疑当前系统通过梯度下降在数据与任务上微调,这些数据与任务和人类价值只是间接相关。sebkrier 回应称,以这种方式构建系统并不必然意味着它会'杀死所有人'。

所属事件:AI安全圈激辩:梯度下降训练能否对齐人类价值观(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →