不用微调:4B 验证器定位隐藏失败,让长程 Agent 更可靠
teortaxesTex · x · 2026-09-21
arXiv 论文《Locating Hidden Failures Makes Long-Horizon Agents More Reliable》指出,长程智能体很少能捕捉到自己的第一个错误,错误会静默级联放大。核心方法:训练一个 4B 的 step-level 验证器来定位失败步骤,并从多条候选轨迹中选择,即可提升任务成功率,且无需对基础 agent 做任何微调。
- 应用场景:编码、OS 世界模型、研究类长程 agent
- 价值:在最终完成前拦截破坏性动作、捕捉静默级联错误、做 best-of-N 轨迹选择
转推者补充实践经验:这类失败更多源于 agent 的错误假设与疏忽,而非显式报错——agent 容易钻进局部极小值的「兔子洞」,必须显式针对这种行为做训练。
「编程与Agent」频道最新
- 用户 Grok 智能体 24/7 待命,睡觉时自动下单买生牛奶 — RachelVT42 · 2026-09-21
- Graphify+Obsidian+Claude Code 三件套:把散乱文件变成可浏览的知识图谱 — alex_verem · 2026-09-21
- 用 Gemini 提取视频上下文重排搜索结果,速度显著提升 — eptwts · 2026-09-21
- Claude Code 被曝 bug:worktree 删除后会话元数据仍残留旧路径 — Aadiboy21 · 2026-09-21
- 重写 vibecoded DuckDB 扩展后性能提升 20-40 倍,Jev 分析工具引关注 — sh_reya · 2026-09-21
- 为语音 Agent 降延迟,Reddit 开发者寻找专用小模型做工具调用 — Snoo_7134 · 2026-09-21