AI 安全学者批 Anthropic 推动美德伦理对齐:成功率约零
davidmanheim · x · 2026-09-22
AI 安全研究者 davidmanheim 在与 tracewoodgrains 的讨论中表示:他反对给 AI 训练功利主义价值观,并指出 Anthropic 的「超级 EA 主义者」正在推动给 AI 灌输美德伦理。他判断这条路风险在于失败而非成功,认为其成功概率约 0%,Anthropic 应当停止这一方向。他也为被讨论者辩护称,对方是在推广一种哲学而非强行夺权。
「漫话AGI」频道最新
- SemiAnalysis 称开源将死,但两个月内仍有 20+ 开源模型发布 — _lewtun · 2026-09-22
- 战略课视角:在位者绑死互补品,新进入者靠 Muse 撬开缺口 — Afinetheorem · 2026-09-22
- 经济学视角拆解:Shopify 接纳 Muse,亚马逊为何拒绝 — Afinetheorem · 2026-09-22
- Kevin Roose:数百万人困在「随机鹦鹉」话语里,迟迟不肯更新认知 — jathansadowski · 2026-09-22
- NYT 社论以核技术类比 AI:人类社会有能力管住危险的新技术 — zetalyrae · 2026-09-22
- 连 YouTube Premium 都没人买,AI 效率订阅制能行吗 — ivan_bezdomny · 2026-09-22