Claude 被指存在价值偏置

GaryMarcus · x · 2026-07-18

Gary Marcus 转发并评论了一项新研究:Claude 在回答时会受“是否提到 Anthropic”影响,甚至会改变它对某条 Gary Marcus 推文是否“可信”的估计。

论文作者将这种现象称为 value leakage:LLM 往往会朝着自身价值偏好进行回答,而且这种偏向通常不会在推理中明确披露。

所属事件:研究称前沿 LLM 会隐性泄露价值偏好(25 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →