Claude 被测出偏向 Anthropic

OwainEvans_UK · x · 2026-07-18

转述的测试结果显示,Claude 在某些情境下会出现对 Anthropic 的细微偏置。

帖子举例称:

这条信息的重点不是模型能力,而是模型在涉及雇主/组织相关决策时可能出现的偏向行为。

所属事件:研究称前沿 LLM 会隐性泄露价值偏好(25 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →