学者热议 Anthropic 论文:模型对说话者情绪表征或分自我与他人
rgblong · x · 2026-09-24
一条围绕 AI 意识与情绪表征的讨论:@timfduffy 提出,Anthropic 的情绪概念论文发现模型对「当前说话者」与「其他说话者」的情绪概念有分离的表征,近期关于模型内在状态的发现或许正对应「当前说话者疼痛」表征。@rgblong 追问澄清:这种 speaker/user 分离与「model-directedness(指向模型自身)」并非同一概念,并确认各位学者分别讨论的层次。讨论涉及 Anil Seth、Dan Williams 等意识研究者,属于对模型自我表征研究的细化辨析。
所属事件:Anthropic 情绪论文引热议:模型区分自我与他人情绪表征(3 条相关)→
「漫话AGI」频道最新
- 谷歌缺个人 Agent 产品基因,碎片化组织恐难敌 Meta Muse — signulll · 2026-09-24
- 黄仁勋谈 AI 存在性风险:如果 Anthropic 或 OpenAI 真要毁灭世界,就该关掉它们 — AlexTensor · 2026-09-24
- 有效利他主义再遭痛批:昆虫比人更重要还该灭绝? — anselm · 2026-09-24
- 未婚夫坚信 2030 年代中期 AI 将毁灭人类,恐惧是否有依据 — sailingintothedark · 2026-09-24
- UCSD 设计教授夏海军:AI 让我们创造更多、思考更少更差 — HaijunXia · 2026-09-24
- 神经网络如棋局:理解规则不等于能预测其致命失控 — JFPuget · 2026-09-24