对齐研究警告:静态偏好会锁死价值观并拖慢社会

edelwax · x · 2026-07-23

这条引用的是一项关于 AI Value Alignment for Evolving Social Norms 的研究,核心是用宏观、人口层面的模型来分析:当 AI 助手被大规模采用后,传统“把偏好当成静态目标”的对齐思路会带来什么后果。

论文提出了三类系统性风险:

作者主张,未来系统应当具备 时间自适应、可推理、多元、且保留用户能动性 的能力。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →