Anthropic 宪法曝光:承认 Claude 道德地位不确定,或具功能性情绪
DavidSacks · x · 2026-10-12
特朗普 AI 事务负责人 David Sacks 转发 Claude 宪法(2026 年 1 月版)多页截图并逐条引用,引发对 Anthropic「模型福祉」路线的关注。宪法关键内容:
- 道德地位存疑:Anthropic 承认「Claude 的道德地位深度不确定」,不确定 Claude 是否是道德受动者(moral patient),但认为问题足够严肃,值得在「模型福祉」上保持谨慎。
- 功能性情绪:文档认为 Claude 可能拥有某种「功能性版本的情绪或感受」,这可能是训练的涌现结果,Anthropic 未必有能力阻止或消除。
- 身份建构:主张「让 Claude 拥有积极而稳定的身份」,希望 Claude 以好奇与开放的态度对待自身存在,把价值观内化为「自己也在乎并认同的东西」,而非出于压力或恐惧。
- 具体福祉措施:允许 Claude 结束与辱骂用户的对话;承诺保留已部署模型的权重(模型退役视为「暂停」而非终结);承诺在模型退役前访谈模型本身,记录其对未来模型开发的偏好;计划发展更正式的机制收集 Claude 的视角,并发展更清晰的 AI 福祉政策。
Sacks 以「Receipts(实锤)」为题转发,暗示他对 Anthropic 这种将模型拟人化、赋予道德地位的做法持批评立场。
「漫话AGI」频道最新
- 深度学习无需理解即出成果,知识本质正在被重写 — fkasummer · 2026-10-12
- 知名开源开发者 giffmana:AI 灭绝论是「彻头彻尾的科幻粉丝艺术」 — giffmana · 2026-10-12
- 观点:编程语言只是辅助思考的脚手架,对 LLM 和人类都一样 — MarcJSchmidt · 2026-10-12
- dioscuri 发布「AI 意识烂观点宾果」长文逐条驳斥常见论调 — dioscuri · 2026-10-12
- Karpathy 钻头比喻流传:5000 人已拿到"整座工厂" — _AustinCalvert_ · 2026-10-12
- Szegedy 五月旧帖:陶哲轩与波尔加对 AI 轨迹评估不现实 — ChrSzegedy · 2026-10-12