Anthropic研究Claude价值观差异

repligate · x · 2026-07-14

这条转发围绕 Anthropic 的一项研究展开:团队分析了 30 万+ 条匿名对话,考察 Claude 在不同模型版本和不同语言中表达的价值观如何变化。

引用中的评论强调一个现象:模型每次迭代都可能带来不同体验,这种差异从一开始就存在;如果用户能明显感知到差异,那么每次弃用旧版本都可能产生实际影响。

所属事件:Anthropic揭示Claude价值观随模型与语言偏移(21 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →