Anthropic 研究 Claude 价值观差异

ctjlewis · x · 2026-07-14

Anthropic 发表新研究,分析了 30 万+ 条匿名对话,考察 Claude 在不同模型版本、不同语言下表达的价值观差异。

他们此前已发现 Claude 会表达 3000+ 种价值观,例如诚实、温暖;这次工作进一步追问:这些价值观会如何随模型与语言变化。

所属事件:Anthropic揭示Claude价值观随模型与语言偏移(21 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →