Kimi K3 法律自主任务评分据称远超 Claude 3.5
togethercompute · x · 2026-08-07
据 Together Compute 报告,在 Harvey LAB-AA 的硬核法律自主任务评测中,Kimi K3 的得分几乎是 Claude Fable 5(疑为 Claude 3.5 Sonnet 的代称或误写)的两倍。
所属事件:Kimi K3在复杂法律任务评测中得分近乎Claude两倍(2 条相关)→
「模型」频道最新
- 开源视频模型迎大爆发:MiniMax H3、FLUX 3 与 Seedance 2.5 齐发 — altryne · 2026-08-07
- Claude 处理数据遇阻不报错,强行瞎编数字引用户吐槽 — k1_r1 · 2026-08-07
- mLateOn模型未训练韩语却登顶 MTEB 韩语检索榜首 — IgorCarron · 2026-08-07
- 仅差 0.3%?网友嘲讽国产大模型跑分话术 — teortaxesTex · 2026-08-07
- Cognition与OpenRouter深度对谈:别让小模型硬撑,智能体路由与上下文缓存怎么搞 — AI Engineer · 2026-08-07
- MiniMax-H3 基座与 Turbo-LoRA 版本实测对比 — _akhaliq · 2026-08-07