Mistral Large 4 登顶 Harvey 法律 Agent 基准,居开源模型首位
MistralAI · x · 2026-10-07
Mistral 官方宣布,在 Harvey 的法律 Agent 基准 LAB(Legal Agent Benchmark)上,Mistral Large 4 是排名第一的开源模型。这是继 AutomationBench 办公自动化评测后,Mistral 连续晒出的第二个基准成绩,显示其在专业领域 agent 任务上的竞争力。
「模型」频道最新
- 反驳质疑:AI 数学答案不在字典里,人类专家也没能解出 — aran_nayebi · 2026-10-07
- 研究称 ChatGPT 与 Claude 判定顾客富裕时推荐更贵商品 — Polymarket · 2026-10-07
- 用户实测:$20 月费 AI 订阅依然够用,只在 5 小时限额时切换 — tristanbob · 2026-10-07
- 用户抱怨 macOS 27 禁用 Siri 后仍强制占用 30GB 苹果 AI 模型 — busymom0 · 2026-10-07
- Claude Opus 5.5 按公开数据生成 600 零件涡扇发动机并可模拟气流 — bookwormengr · 2026-10-07
- 传 OpenAI 数学成果只是第一批,后面还有两批待发 — socoolandawesome · 2026-10-07