LLM-as-a-Verifier 用连续分数提升 agent 评测

solyarisoftware · x · 2026-07-22

LLM-as-a-Verifier 提出训练无关的通用验证框架

这篇论文提出 LLM-as-a-Verifier,目标是在不额外训练的前提下,为 agent 任务提供更稳健的验证能力。它不用传统的离散评审分数,而是直接利用 scoring token logits 的连续分值,把判断信号做得更细。

作者指出,验证效果会在以下做法下明显提升:

论文声称,这套方法在 代码、机器人、医疗 等基准上都能提高准确率,核心价值是为 agentic workflow 提供更可扩展的验证层。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →