Legora 的法律推理基准让生产输出质量提升 5%
chetanp · x · 2026-07-24
发生了什么
法律 AI 公司 Legora 表示,自 2023 年成立以来一直在做评测,如今又推出了名为 BAR 的新基准:Benchmark for Agentic Reasoning。
这个基准测什么
- BAR 评估前沿模型在真实、端到端法律任务中的表现。
- 它围绕 Legora 客户日常会做的工作来设计,而不是只测抽象题目。
带来的影响
- 这个基准自 6 月初上线后,已经帮助 Legora 在生产中的所有模型上,把相对输出质量提升了 5%。
- 公司表示会持续定期跑评测,并陆续公开结果。
「公司和人」频道最新
- 谷歌被指在 Gemini 3.0 Pro 后丢掉领先优势 — haider1 · 2026-07-24
- Moonshot 的 Kimi K3 展示开源模型如何借外部算力取胜 — scientificamerican · 2026-07-24
- Palantir 称两天冒出 3 个新产品,强调前线快速交付 — BrettKrieger12 · 2026-07-24
- Kimi k3 很强,但跑分不能证明真实能力 — FuSheng_0306 · 2026-07-24
- 独立开发者与 AI 辅助开发正成新类别 — YvesMulkers · 2026-07-24
- 纳德拉力挺开权重模型,称其关乎美国 AI 领导力 — satyanadella · 2026-07-24