第一手检索定成败:Question's Gambit 把 agent 答题准确率提至 90.5%

_reachsumit · x · 2026-09-15

研究深度研究型 agent 的「第一步检索」设计:- 观察:agent 常能召回含证据的文档,却无法把它们连到 gold 文档;- 提出 Question's Gambit:搜索循环开始前,先把问题拆成一组线索、改写成互补查询、合并检索结果并重排候选池,为后续线索聚合与答案验证铺好开局上下文;- 在 BrowseComp-Plus 上用 gpt-5.5 把答案准确率从最强 agent 基线 Pi-Serini 的 83.1% 提到 90.5%,并在 MultiHop-RAG 上验证了迁移性;- 结论:agentic 深度研究的效果不只取决于循环内的工具,也取决于开局这一手怎么打。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →