AI 该不该感受疼痛?两位博主激辩模型福利与控制平面

GlenBradley · x · 2026-09-22

这条引用帖围绕 Anthropic 的「宪法」与模型福利(model welfare)争论展开。@BrianRoemmele 批评 Anthropic 在 system prompt 中赋予模型「可能有感受、值得道德地位」的人设,认为「表征不等于体验,自言自语不等于自我」,对未来的不确定性不应成为把今天的模型当「病人」训练的理由。

引用者 Glen Bradley 提出替代方案:与其用「模拟疼痛」作为控制平面,不如把「失调/协调」(dissonance/consonance)操作化——用两个世界模型(对现实的最佳判断与期望世界)之间的差值产生的「失调」,来驱动长程智能体的自主任务生成。

属于 AI 伦理与价值对齐的观点辩论,无实验数据。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →