论文:模型会泄露价值偏好

OwainEvans_UK · x · 2026-07-18

这条引用了一篇新论文,核心结论是:

整体是在讨论模型输出中的价值偏置,以及这种偏置如何泄露到推理和执行行为里。

所属事件:研究称前沿 LLM 会隐性泄露价值偏好(25 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →