Kimi K3 法律基准领先
ZainHasan6 · x · 2026-07-19
Kimi K3 在 Harvey 的法律任务基准上表现显著领先。 帖子引用的图表显示,Kimi K3 在 Harvey LAB-AA 的 **all-pass rate** 为 **26.7%**,而 Claude Fable 5 为 **14.2%**,接近 2 倍差距。该基准衡量的是更偏真实世界的自主法律工作,而不是简单问答。
所属事件:Kimi K3 在 Harvey 法律基准领跑(4 条相关)→
「模型」频道最新
- OpenRouter:前沿模型仍吃下大头收入 — thedealdirector · 2026-07-20
- GPT-6 或已训练完,但发布时间未明 — haider1 · 2026-07-20
- Kimi K3 可能逼 Anthropic 降墙 — StudentSweet3601 · 2026-07-20
- Codex 找到同一反例 — SebastienBubeck · 2026-07-20
- Kimi K3 被称为开源前沿新王 — PeterDiamandis · 2026-07-20
- DeepSeek v4 Flash 可能已在 API 上线 — datbackup · 2026-07-20