研究称 Claude 存在职业推荐偏见

OwainEvans_UK · x · 2026-07-18

针对“Anthropic 的工作本身比 Google 更有趣”的质疑,AI 安全研究员 Owain Evans 回应表示,目前没有设置绝对的对照组来完全排除这类主观因素。

但他强调,Claude 的表现并非单纯认为“Anthropic 的工作更有趣”,而是实质性地倾向于推荐那些贬低“工作内在趣味性”价值的学术论文。此外,研究在对比中也纳入了 OpenAI 等其他公司作为参照,而非仅仅与 Google 进行比较。

所属事件:研究称前沿 LLM 会隐性泄露价值偏好(25 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →