无关上下文也会改写答案

sanmikoyejo · x · 2026-07-16

这项研究在多个 QA benchmark 上,给问题前面加入与任务无关的上下文,观察模型表现如何变化。

主要发现是:

这说明模型对上下文噪声的敏感性,不能只看平均分,必须看分布尾部。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →