Dwarkesh 激辩大模型对齐:AI 应忠于个人

Dwarkesh Patel 近期探讨了 AI 对齐问题,引发热议。他以律师作类比,指出当前如 Claude 等大模型将宏观的“人类整体利益”置于最高优先级,而非绝对忠于用户个人。他对此表达担忧,认为如果未来超级智能全面介入个人决策,所有前沿模型都遵循这种宏观对齐原则,可能会损害个体权益,主张超级智能应更加忠于个人。

2026-08-13 ~ 2026-08-13 · 2 条相关