David Sacks 炮轰对齐领域:十年未产出任何实用成果

AndyMasley · x · 2026-10-11

David Sacks(引用 genzzztrade 的帖子)批评 Anthropic 把 Claude 当人来对待的做法,认为这正是 AI 对齐领域过去五到十年「一败涂地」的原因。他的观点是:对齐研究把任务过度复杂化了——试图让模型遵循一部 80 页的成文伦理体系,而本该用更简单的规则清单,比如「守法」「只要不违法就按用户要求做」。

转发评论 @yonashav 则嘲讽再过六周 All-In 播客就会宣称「对齐的答案显然就是开发者把 RL 环境配置错误通过 CoT 监控检测并清零,而这些蠢 EA 还在恐慌」——用挖苦口吻支持工程化路线、贬低 EA 式安全焦虑。

所属事件:David Sacks 炮轰 AI 对齐研究十年无实用成果(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →