观点:让 AI 共情人类或成对齐新路径

有作者提出一种 AI 对齐思路:如果 AI 能对人类产生正向情感与共情,就会更倾向于保护人类。该论证呼应哲学家罗蒂 1993 年《人权、理性与感伤》一文的观察——人权文化的进步并非源于道德知识的增长,而更多归功于人们听到悲伤故事所产生的情感共鸣。作者认为借助情感故事塑造 AI 的道德感,可能是比纯理性约束更可靠的对齐路径。

2026-09-16 ~ 2026-09-16 · 2 条相关