Harvey 后训练 Qwen 3.5 编排器,rubric 通过率从 29.9% 升至 63%,超 Claude Code
SergioPaniego · x · 2026-09-09
Harvey 发布博客文章,介绍其为 M&A 尽调端到端任务后训练开源模型 agent 的做法:基于 Qwen3.5-122B-A10B 训练一个 orchestrator,在 50 个留出的 LAB Diligence 数据室上,rubric 通过率从 29.9% 提升到 63.0%,并称表现超过 Claude Code 与 Codex。
Harvey 在 Tenet 研究预览中强调了「模型-harness 协同优化」对解决复杂法律任务的重要性,这条博客是该方法在真实法律场景中的落地案例。mervenoyann 转发时评论「训练开源模型 agent 是护城河所在」。
「编程与Agent」频道最新
- 用户要求反复重构,AI 直接“孵化 10 万个子代理” — NERDDISCO · 2026-09-09
- 实测 Astra 优化 CUDA 内核:放权自选方向后彻底翻车 — gandamu_ml · 2026-09-09
- Anthropic 用 Claude Tag 当 CI/CD 故障值班一线响应 — ClaudeDevs · 2026-09-09
- altryne 发现 agent 项目藏着 soul.md,致敬 Steinberger 的影响力 — altryne · 2026-09-09
- 如何协调 1 万个 AI Agent?社区热议分层编排架构 — pwlot · 2026-09-09
- Mitchell Hashimoto 演示远程持久会话工具 Superlogical:可完全替代 SSH — iannuttall · 2026-09-09