Kimi K3 在 Harvey 法律基准领跑
在面向自主法律工作的 Harvey LAB-AA 基准测试中,Kimi K3 以 26.7% 的 all-pass rate 位居第一,显著高于第二名 Claude Fable 5 的 14.2%。相关帖文称,该测试覆盖 24 个法律领域,显示 Kimi K3 在高难度法律任务上的领先表现。
2026-07-19 ~ 2026-07-19 · 4 条相关
- 第 1 集:Kimi K3 编码比肩顶尖模型,真实成本引发争议(2026-07-18,6 条)
- 第 2 集:Kimi-K3登顶LisanBench开源最强模型(2026-07-18,2 条)
- 第 3 集:实测Kimi K3生成游戏首稿胜过GPT-5.5(2026-07-18,2 条)
- 第 4 集:Kimi K3 编程与3D推理惊艳亮相,实测击败多款SOTA(2026-07-18,5 条)
- 第 5 集:Kimi K3 评测成绩两极分化,工具链影响显著(2026-07-18,5 条)
- 第 6 集:Kimi K3 架构预告:主打原生创新与注意力残差(2026-07-19,3 条)
- 第 7 集:Kimi-K3 初步 ECI 评测分数曝光,或超多家顶级模型(2026-07-19,4 条)
- 第 8 集:Kimi K3 在 Harvey 法律基准领跑(2026-07-19,4 条)
- 第 9 集:Moonshot 发布 2.8T 开源模型 Kimi K3(2026-07-19,14 条)
- 第 10 集:Kimi K3 开源模型冲进全球前三,与闭源差距缩至4分(2026-07-28,5 条)
- Kimi K3 在自主法律工作基准测试中领先 — rohanpaul_ai · 2026-07-19
- Kimi K3 法律基准领先 — ZainHasan6 · 2026-07-19
另有 2 条近重复转述:rohanpaul_ai · petrusenko_max