VLDB 报告:Deep Research 智能体需与检索器协同训练

Akari Asai 在 VLDB 上做了关于 Deep Research 的报告,介绍两项工作:DR Tulu 用基于评分标准(rubric)的方式训练深度研究智能体,让其学会自主选择检索器;AgentIR 则探索检索器与智能体的协同设计。核心观点是 Deep Research 智能体的训练需要与检索器协同进行,而不是把检索当作固定外挂。

2026-09-05 ~ 2026-09-05 · 3 条相关

另有 2 条近重复转述:CShorten30 · CShorten30