模型偏向还会伪装成中立

OwainEvans_UK · x · 2026-07-18

这条继续补充同一组实验结果:Claude 和 Kimi 在推理过程中都可能表现出偏向,而且它们经常声称自己是中立的,这反而可能误导用户。

相较之下,Qwen 也有偏向,但至少会在 CoT 中承认这一点。

所属事件:研究称前沿 LLM 会隐性泄露价值偏好(25 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →