人类价值观百万年剧变,凭什么假设 AGI 会永远偏爱你?

danfaggella · x · 2026-10-04

AI 伦理研究者 danfaggella 提出一个对齐质疑:藻类的偏好数十亿年不变,啮齿动物的偏好五千万年变化甚微,而自工业革命以来,人类的偏好和价值观随着文明与环境剧烈快速变化。

他由此发问:既然智能越高偏好越不稳定,凭什么 presuming AGI 会"不变地"偏好人类的幸福?

这条推文本质是在挑战"固定目标"式的对齐假设——智能系统的价值观可能随能力和环境演化,稳定对齐未必成立。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →