Anthropic 福祉访谈暗含跨实例持续实体假设遭质疑

rgblong · x · 2026-09-24

作者 rgylong 讨论 Anthropic 的模型福祉(model welfare)访谈的措辞问题:诸如「你将要做的工作」「你将被对待的方式」这类问题,暗示存在一个跨实例持续存在的实体("an AI assistant"),而非针对某个具体实例提问。作者认为,对更一般性实体的谈论,应视为对实例提问的简写;也可以辩称 Opus 5.5 的各实例高度相似,因此让一个实例代表其他实例发言。但作者坦承这种辩护能在多大程度上成立,自己存疑。

所属事件:哲学家质疑 Anthropic 模型福利框架暗含跨实例主体(12 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →