David Sacks 称 AI 对齐十年无产出, binarybits 以 RLHF 反驳

deanwball · x · 2026-10-12

白宫 AI 负责人 David Sacks 炮轰 Anthropic 把 Claude「当人训练」,认为给模型编写 80 页伦理准则而非简单守法规则,是对齐领域过去十年「毫无实际产出」的失败原因。

Timothy Lee(@binarybits)转发并反驳:这一说法哲学上站不住脚,事实上也不成立——现代聊天机器人的基石技术 RLHF,正是 OpenAI 和 DeepMind 的安全研究员作为对齐技术开发出来的。

这场争论折射出业界对「对齐是否有价值」的路线分歧:是复杂的价值观规训,还是简单的规则约束。

所属事件:白宫 AI 负责人 Sacks 炮轰对齐研究十年无产出(5 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →