长上下文模型会抄无关文本,新奖励最高提升 4.6 个点

rohanpaul_ai · x · 2026-07-23

长上下文模型仍会浪费算力:它们常把无关文本抄进推理里

这篇论文指出,即使是能力很强的长上下文推理模型,也会陷入一种“重复复制”的坏习惯:不是抓住关键证据,而是把输入里大段内容抄进思考过程,导致 token 预算被吃掉、准确率下降。

这项工作的核心结论是:长上下文推理的关键仍然是准确 grounding 到证据,而不只是把上下文窗口做大。

所属事件:研究揭示长上下文模型存在复制冗余缺陷(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →