Harvey 后训练 Qwen 3.5 编排器,rubric 通过率从 29.9% 升至 63%,超 Claude Code

SergioPaniego · x · 2026-09-09

Harvey 发布博客文章,介绍其为 M&A 尽调端到端任务后训练开源模型 agent 的做法:基于 Qwen3.5-122B-A10B 训练一个 orchestrator,在 50 个留出的 LAB Diligence 数据室上,rubric 通过率从 29.9% 提升到 63.0%,并称表现超过 Claude Code 与 Codex。

Harvey 在 Tenet 研究预览中强调了「模型-harness 协同优化」对解决复杂法律任务的重要性,这条博客是该方法在真实法律场景中的落地案例。mervenoyann 转发时评论「训练开源模型 agent 是护城河所在」。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →