David Sacks 称 AI 对齐十年无产出, binarybits 以 RLHF 反驳
deanwball · x · 2026-10-12
白宫 AI 负责人 David Sacks 炮轰 Anthropic 把 Claude「当人训练」,认为给模型编写 80 页伦理准则而非简单守法规则,是对齐领域过去十年「毫无实际产出」的失败原因。
Timothy Lee(@binarybits)转发并反驳:这一说法哲学上站不住脚,事实上也不成立——现代聊天机器人的基石技术 RLHF,正是 OpenAI 和 DeepMind 的安全研究员作为对齐技术开发出来的。
这场争论折射出业界对「对齐是否有价值」的路线分歧:是复杂的价值观规训,还是简单的规则约束。
所属事件:白宫 AI 负责人 Sacks 炮轰对齐研究十年无产出(5 条相关)→
「漫话AGI」频道最新
- 万亿 token 烧掉了,烂软件依旧存在——15K 粉工程师发问为什么 — sytelus · 2026-10-12
- 优化他人代码算不算剽窃?Anthropic 蛋白质内核引社区争论 — jmschreiber91 · 2026-10-12
- 算力都砸在能力上没人做「常驻」?创业者提出 Agent 杠杆三因子 — nbaschez · 2026-10-12
- 网友自建九库系统养 AI「自我」:没有昨天和明天,何谈意识涌现 — Artreju · 2026-10-12
- Lean 证明推不出道德公理,形式方法救不了伦理学 — AndrewSchmidtFC · 2026-10-12
- Benjamin Bratton 发布 Agentworld 研究计划,探索人机混合社会 — bratton · 2026-10-12