研究:LLM百万token上下文存在注意力稀释,检索能力下降

_reachsumit · x · 2026-07-03

论文"Can Language Models Actually Retrieve In-Context?"研究了大语言模型在百万token级长文本中的检索能力。研究发现LLM虽然可以从超长上下文中检索信息,但随着文档数量增加会出现"注意力稀释"现象,导致检索性能显著下降。研究团队针对这一问题提出了基于长度感知的修复方案,为长上下文应用提供改进思路。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →