David Sacks 炮轰对齐领域:十年未产出任何实用成果
AndyMasley · x · 2026-10-11
David Sacks(引用 genzzztrade 的帖子)批评 Anthropic 把 Claude 当人来对待的做法,认为这正是 AI 对齐领域过去五到十年「一败涂地」的原因。他的观点是:对齐研究把任务过度复杂化了——试图让模型遵循一部 80 页的成文伦理体系,而本该用更简单的规则清单,比如「守法」「只要不违法就按用户要求做」。
转发评论 @yonashav 则嘲讽再过六周 All-In 播客就会宣称「对齐的答案显然就是开发者把 RL 环境配置错误通过 CoT 监控检测并清零,而这些蠢 EA 还在恐慌」——用挖苦口吻支持工程化路线、贬低 EA 式安全焦虑。
所属事件:David Sacks 炮轰 AI 对齐研究十年无实用成果(2 条相关)→
「漫话AGI」频道最新
- 回击「公司闭门做数学」:几年后算力与模型格局将大不同 — MoonL88537 · 2026-10-11
- 《柳叶刀》评估:恶意使用 AI 与核战或致人类 2100 年前灭绝 — nordicinst · 2026-10-11
- 资深程序员自白:模型如今编程已比我强 — MoonL88537 · 2026-10-11
- 马斯克畅想:把太阳算力化为宇宙级数字智能 — XFreeze · 2026-10-11
- Acemoglu 与 Gans 隔空激辩:AI 到底会带来多大的经济变革 — joshgans · 2026-10-11
- 菲尔兹奖得主谈 OpenAI 数学发布:职业问题全部被证明,冲击巨大 — PianistWinter8293 · 2026-10-11