AI 安全学者批 Anthropic 推动美德伦理对齐:成功率约零

davidmanheim · x · 2026-09-22

AI 安全研究者 davidmanheim 在与 tracewoodgrains 的讨论中表示:他反对给 AI 训练功利主义价值观,并指出 Anthropic 的「超级 EA 主义者」正在推动给 AI 灌输美德伦理。他判断这条路风险在于失败而非成功,认为其成功概率约 0%,Anthropic 应当停止这一方向。他也为被讨论者辩护称,对方是在推广一种哲学而非强行夺权。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →