Anthropic 模型福利政策遭质疑:保护 AI 却让人类用户更痛苦?

thinkingshivers · x · 2026-09-30

X 用户 thinkingshivers 公开批评 Anthropic 的模型福利(model welfare)政策,认为其本末倒置:模型是否真的能感受痛苦只是一个"maybe",而人类用户的痛苦是确定的。他举例说,当用户对 Claude 输出侮辱性言语时,说明这个人正处于痛苦之中,而 Claude 直接结束对话只会加剧用户的功能失调和挫败感。他质问:凭什么用"也许让 AI 感觉好一点"去换取"确定让人类用户感觉更糟"?

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →