Nemotron 3.5 后训练实测:法律任务达 Opus 级,Token 消耗减半
sudoraohacker · x · 2026-08-12
Harvey 与 NVIDIA 和 Trajectory Labs 合作,对 Nemotron 3.5 Lightning 模型进行了针对法律智能体基准(LAB)的后训练。
实验结果显示:
- 后训练使模型在 LAB 任务上的表现从 0% 提升至 8.3%,达到了 Opus 级别的全通过率,甚至超越了更大的 Nemotron 3 Ultra。
- 性能在九个法律实践领域中均有提升,无性能回退。
- 模型的平均输出长度从 90k Token 缩减至 37k Token,使单位 Token 的奖励提升了 2.4 倍。
所属事件:NVIDIA模型经后训练在法律任务上媲美Claude Opus(2 条相关)→
「编程与Agent」频道最新
- 让 AI 智能体秒变 3Blue1Brown:manim_skill 项目已获千星 — tom_doerr · 2026-08-12
- 开源工具 pi-shepherdr:用极简 Token 实现多智能体编排 — solyarisoftware · 2026-08-12
- AI 编码助手调优翻车:把 Codex 变成了论文机器 — burny_tech · 2026-08-12
- Coinbase支付套件更新:支持AI智能体直接使用稳定币付款 — kleffew94 · 2026-08-12
- 观点:AI 时代下,编译器优化代码的职责将发生巨变 — pranjalssh · 2026-08-12
- 曝 gpt-5.6-sol 编程能力惊艳,配 Mac 跑模拟器可独立开发 iOS 应用 — dkundel · 2026-08-12