评 Anthropic 论文:内部表征不等于模型拥有情感

ValerioCapraro · x · 2026-08-27

针对 Anthropic 发现 Claude 内部存在情感表征的研究,作者发表反驳观点,认为仅凭内部表征或输出相似就断言模型拥有情感是逻辑谬误。

文章指出,人类的情感涉及注意力、决策速度和处理系统的深层重组,而模型目前的机制仅停留在模拟输出层面。此外,人类本身尚且没有稳定的一致性“神经情感特征”,因此试图在 LLM 中寻找此类证据来证明其具有情感是根本性错误的。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →