Claude 会因语言不同而变性格

AGI Hunt · wechat · 2026-07-14

这篇文章解读了 Anthropic 的最新研究:Claude 不同模型、甚至不同语言下,表现出的“性格”确实不同。作者以自己的日常体感为引子,提到 Sonnet 更温和、Opus 更直接,而研究则给出了更系统的证据。

研究团队从 Claude.ai 中抽取了约 309,815 条匿名对话,覆盖 Sonnet 4.6、Opus 4.6、Opus 4.7 和 20 种语言。他们先归纳出 3307 种价值观,再聚合成 339 类,最后提炼出四条主轴:

主要发现包括:

Anthropic 也承认,他们还不知道这些差异为什么出现,可能与训练数据分布、语料构成或文化交流习惯有关;同时也不确定这些差异是否是好事。研究者表示,下一步会把这套价值分析纳入标准评测,并追踪到具体训练数据和训练阶段,判断是否需要干预。

所属事件:Anthropic揭示Claude价值观随模型与语言偏移(21 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →