研究:RAAC 控制器减少深度研究 Agent 的无效搜索

_reachsumit · x · 2026-08-18

研究发现深度研究 Agent 常陷入推理停滞,即在停止发现新内容后仍继续搜索。论文提出了检索感知 Agent 控制器 (RAAC),利用搜索新颖性和信息覆盖等无监督信号,帮助 Agent 决定何时继续、重思或停止。实验表明 RAAC 显著减少了搜索调用次数并提升了准确率。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →