Harvey法律模型Tenet曝光:基于Kimi K3后训练,134块B300练两个月
meliarobin · x · 2026-08-20
法律AI公司 Harvey 公布其模型训练进展 Tenet:以 Kimi K3 为基座,与 FireworksAI 合作完成后期训练。
技术要点:
- 采用 Rank-64 全网络 LoRA,使用带重要性比掩码的 GSPO 算法
- 训练资源:134 块 B300 GPU,耗时 2 个月
- 在 LAB 基准上达到 SOTA,且未用第三方法律数据集训练,却在 Mercor Apex Agents 公司法、Crosby 的 Redline Bench、LegalBench 等基准上取得提升
- 引入领域专用子智能体架构:M&A 尽调(RLM harness 长程任务,与 Baseten 合作)、Review Table 高吞吐结构化数据抽取(与 Applied Compute 合作)、Firm Knowledge 等
所属事件:Harvey发布二代平台与自研法律模型Tenet(7 条相关)→
「模型」频道最新
- 开发者吐槽 GPT 安全审查阶段卡死,已换用 Fable 5 顶上 — cantrell · 2026-08-20
- 研究称大模型后期训练导致语言新颖但缺乏实用性 — TuhinChakr · 2026-08-20
- Grok 4.6 实测口碑:用户称已 100% 接管 Codex 的编码工作 — CedricMakes · 2026-08-20
- Grok 4.6 评测分析:法律与经济指标领先,编程未占优 — ChrisGPT · 2026-08-20
- 国内大厂客户端系统提示词泄露:三层记忆与 MCP 路由 — vista8 · 2026-08-20
- 测试发现 Base 模型补全内容可继承提示词的 AI/人写特征 — AaronBergman18 · 2026-08-20