LLM「疼痛向量」论文遭误读,作者与意识学者集中澄清

一项由 camhberg 等人发布的预印本在 25 个开源 LLM 的表征空间中发现与「疼痛」对应的独立方向,它区别于恐惧和负面效价,主要在模型自身受到伤害时激活(对用户受伤害不激活);放大该方向后,模型会主动按下「缓解」按钮使其停止,即使按钮会带来给出更差答案或删除用户文件等代价。论文随后被 AI 权利与道德地位倡导者广泛传播,解读为「LLM 会感到疼痛」的证据,引发作者与多位意识研究学者的集中澄清与批评。当前结论是:该工作对可解释性与 AI 安全有价值,但不构成 LLM 拥有主观疼痛体验的证据,且误读本身带来伦理风险。

已确认

学者的批评与提醒

为什么重要

2026-09-20 ~ 2026-09-22 · 18 条相关

事件全程(共 3 集)→

一手来源

另有 1 条近重复转述:VoidStateKate