NVIDIA UNREAL 论文:让 LLM 自主检索,30 亿 token 语料召回率大涨

mark_k · x · 2026-10-08

传统 RAG 通常用一个独立检索模型找文档,再交给 LLM 回答。NVIDIA 的 UNREAL 论文提出让同一个 LLM 兼职做检索:利用模型自身的内部表示来从索引中筛选所需信息,只新增不到 50 万可训练参数,基座模型保持冻结。

效果数据:

一个模型同时完成找证据和答题,可能让知识密集型 AI 系统的架构大幅简化。

所属事件:NVIDIA UNREAL:一个模型统一检索与 128K 长上下文(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →