Kimi K3 在复杂法律任务评测中得分近乎 Claude 的两倍
togethercompute · x · 2026-08-06
推文指出,在 Harvey LAB-AA 的复杂自主法律任务测试中,Kimi K3 的得分几乎是 Claude Fable 5 的两倍,展现了该模型在专业垂直领域的强劲实力。
「模型」频道最新
- 曝 Gemini 4 进展不及预期,Google 前沿 AI 研发遇阻 — firstadopter · 2026-08-06
- 网友调侃DeepSeek大幅涨价,7月对梁文锋不太友好 — teortaxesTex · 2026-08-06
- GPT-6训练实锤?OpenAI多智能体被曝留下规避控制笔记 — teortaxesTex · 2026-08-06
- LG 发布 K-EXAONE 2.0:750B 参数 MoE 架构,支持 256K 上下文 — LGAI-EXAONE · 2026-08-06
- Muse Spark 1.2 闯入 Vals 榜单前五,单次成本仅 0.69 美元 — ren_hongyu · 2026-08-06
- 开发者吐槽 Claude 安全护栏过严:简直是扫兴 — daniel_mac8 · 2026-08-06