Agent 工具调用常报假成功?新论文揭示四种失败模式

silentw111 · reddit · 2026-08-21

大多数 Agent 框架将工具调用视为原子操作,但实际上“返回成功”和“产生效果”是两回事。新论文《Verified Tool Calls Improve LLM Agent Reliability》指出了四种非原子失败模式(超时后分发、延迟可见、部分成功、陈旧冲突)。实验表明,在高故障率下,添加独立后置验证可将 activatecustomer 的成功率从 64% 提升至 100%,并将重复副作用从 72% 降至 20%。这提示开发者应验证调用后的实际效果,而不仅仅是依赖工具的响应码。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →