CoVeR 论文:嵌入覆盖度门控砍掉 62-68% Agent 验证器调用
_reachsumit · x · 2026-09-23
arXiv 论文《CoVeR: Coverage-Based Routing of Verifier Calls in Agentic Retrieval》(Daeyoung Roh, Donghee Han)。
- 问题:agentic 检索系统中,LLM 验证器逐步判断证据是否足够、可否停止,但每步都重新处理不断增长的全部证据,重复成本很高。
- 方法:CoVeR 用冻结句向量模型的“证据覆盖度边际”单一阈值作门控——覆盖度明显不足时直接跳过验证器调用,只在模糊地带才调用;路由侧还可蒸馏为 921k 参数的小头部,推理环内无 LLM。
- 结果:在三个多跳 QA 基准上,答案精度与全量验证基线差距不到 1 个 EM 点,验证器调用减少 62-68%,饱和场景下可达 93%;基于证据条数、词面重叠或 BM25 的路由效果均更差,且该门控跨决策器和 agent 规模迁移无需重调。
- 局限:同一覆盖度信号无法取代验证本身——“匹配一条声明”远比“判断声明被支持”容易。
「编程与Agent」频道最新
- 开源运行时 Kiso:工具执行崩溃后「无回执」状态如何恢复 — niurenwangdadan · 2026-09-23
- 开源 GUI 智能体跨设备实测:复合任务最佳成功率仅 8% — maier_ak · 2026-09-23
- JarvisGUI 基准:跨 Android/Windows/Ubuntu 考验 GUI 智能体 — maier_ak · 2026-09-23
- 新基准 Cross-DURIAN:专测多设备 GUI 智能体跨屏协作能力 — maier_ak · 2026-09-23
- 个人 Agent 的「主动」要分层看:提醒、提案还是替你干完? — sujingshen · 2026-09-23
- 开源工具 Enola 用代码库结构图谱约束 AI 编码智能体 — yellow-llama1 · 2026-09-23