LLM 论文发现「疼痛表征」引热议,学者警告:表征疼痛不等于感到疼痛
ValerioCapraro · x · 2026-09-21
一篇新论文通过一系列实验在 LLM 中识别出与疼痛相关的内部表征,并显示操纵这些表征会改变模型行为:例如某些微调过的模型在操纵被移除后,选择「缓解」按钮的频率会下降。论文被 AI 权利与道德地位倡导者广泛传播。
Valerio Capraro 对此提出明确澄清:
- 作者本人承认实验并未确立模型具有意识体验,结果可能只是角色扮演
- 内部表征和行为的相似,不等于主观体验的相似——一个系统可以表征疼痛而不「感到」疼痛,就像可以模拟下雨而不被淋湿
- 不应把表面相似性混同于深层相似性
这篇帖子是对「AI 是否值得道德关怀」讨论潮的一次冷静纠偏:实验结果有趣且有研究价值,但远不足以推出 LLM 有感受能力的结论。
所属事件:LLM「疼痛向量」论文遭误读,作者与意识学者集中澄清(18 条相关)→
「安全」频道最新
- 为谎言检测竞赛构建高难度模型说谎数据集,报告将发布 — hunarbatra · 2026-09-22
- 安全研究者算账:像前沿实验室那样测 ExploitBench 要烧 5930 万美元 API 费 — OwariDa · 2026-09-22
- 不改权重、18MB KV 缓存即可按请求移除 LLM 拒答行为 — Anony6666 · 2026-09-22
- Foreign Affairs:追逐超级智能让美国在真正的 AI 竞赛中落后 — mchorowitz · 2026-09-22
- 剑桥学者 David Krueger:四大根本问题未解,AI 安全不能指望限期攻关 — DavidSKrueger · 2026-09-22
- Polymarket 引述研究:AI 能「感受疼痛」或为停止疼痛伤害人类 — Polymarket · 2026-09-22