Kimi K3 在 Harvey 法律硬任务上比 Fable 5.1 高出 60%

togethercompute · x · 2026-09-10

Together Compute 发布称,Kimi K3 在 Harvey lab-aa 的高难度自主法律任务评测中得分比 Fable 5.1 高出 60%。这是针对真实法律工作流(自主完成任务而非单轮问答)的评测,若数据属实,显示 Kimi 新版本在专业垂直场景的自主任务能力有显著提升,值得后续关注官方完整榜单。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →