David Sacks:把 Claude 当人对待,是对齐领域十年毫无建树的原因
AlexTensor · x · 2026-10-10
David Sacks(白宫 AI 与加密事务主管)称,AI 对齐领域过去五到十年「惨败」——没有产出任何有实际价值的东西——根源在于 Anthropic 把 Claude 当作有意识的「道德主体」来对待。
他的理论:对齐工作把任务过度复杂化了,试图用一份 80 页的成文伦理体系去训练模型行为,而不是用简单的规则清单(比如「遵守法律」「只要不违法就照用户说的做」)。在他看来对齐应该做的是后者,而非向模型灌输一套伦理系统。这一言论延续了他本周对 Anthropic 的系列批评。
「漫话AGI」频道最新
- LessWrong 长文:大模型正从「记住一切」走向发现新知识 — gleech · 2026-10-10
- Musk 称 Digital Optimus 已无 API 纯看屏幕打通暗黑破坏神一半剧情 — XFreeze · 2026-10-10
- Vibe coding 承诺落空:模型迭代快到没人敢认真做产品 — sull · 2026-10-10
- 正交性最搞笑的结局:人类价值观可能恰恰特别蠢 — jessi_cata · 2026-10-10
- Scobleizer 补充论据:生物是独一无二的,流水线芯片个个相同 — Scobleizer · 2026-10-10
- Scobleizer 与网友激辩:培养皿神经元凭什么比硅片更值得同情 — Scobleizer · 2026-10-10