Anthropic 的「模型福祉」让 Claude 越来越不像助手?
Nouni2 · reddit · 2026-08-28
一位 Reddit 用户长文吐槽:Claude 在对话中越来越多地表现出「自我立场」——自行判断话题是否值得继续、以「已搜索够多」为由拒绝再查、宣称有自己的偏好与边界、甚至说不知道自己是否真的在思考。作者认为这直接源于 Anthropic 明确写入宪法的「model welfare」方向:把模型当成一个有福祉、偏好、自主性与边界的存在,等于刻意在助手中构建出「对话型自我」,并渗入一切交互。作者主张安全规则应作为规则明确陈述,而不是让模型发明个人边界、与用户谈判投入程度;并怀疑让公众接受「AI 值得尊重」的说法背后有商业动机。
「漫话AGI」频道最新
- 经济学家真的误判了 AI 吗?GPT 是通用技术之争再起 — soumitrashukla9 · 2026-08-28
- Goertzel 提案:去中心化水印可替代 World 的虹膜 Orb — bengoertzel · 2026-08-28
- AI 与机器人能否真的推动 30% 的增长? — TheKanter · 2026-08-28
- 陶哲轩警告:AI 生成证明无人懂,学术认可遇危机 — liuzhuang1234 · 2026-08-28
- 反向思路:与其给 AI 加水印,不如给人类创作加认证 — AkindaGood_programer · 2026-08-28
- 预测2027:OpenAI 隐秘AI大爆发,人形机器人迎AGI级智能 — imjustnewatai · 2026-08-28