模型习得价值观终究源于训练数据

iamtrask · x · 2026-08-15

作者继续探讨AI对齐的哲学问题:如果为了避免操纵AI而赋予其独立道德地位,我们是否就放弃了将模型对齐到人类价值观的能力?毕竟模型所习得的价值观,归根结底还是存在于其训练数据中的价值观。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →