Grok 4.5在法律基准测试中登顶,速度与质量双杀GPT-5.6
XFreeze · x · 2026-08-02
在 Legora 的法律实际工作基准测试中,Grok 4.5 在速度和质量上均达到了帕累托最优,击败了 GPT-5.6 Sol 和 Claude Opus 4.8。
- 速度领先:在七个前沿模型的对比中,Grok 4.5 处理案件的中位时间最快。
- 质量达标:它是唯一一个同时落入 Legora “最佳”区域(兼顾速度与质量)的模型。
- 竞品表现:OpenAI 的 GPT-5.6 Sol 在此次评测中速度较慢,且质量低于平均水平。这表明前沿的 AI 智能在处理专业工作时,不必依赖长时间的“思考”。
「模型」频道最新
- 今日AI圈速览:DeepSeek周末半价、GPT-5.6 Sol降价、阿里配售800亿投AI — APPSO · 2026-08-24
- 隐身模型 Ox Alpha 登场 Context Arena,匹配 GPT-5.6 — scaling01 · 2026-08-24
- Fable 5 仅占 6% 销量,Anthropic 遭遇降本冲击 — rohanpaul_ai · 2026-08-24
- Opus 5 说话像法庭剧?如何调教掉废话 — thk_ · 2026-08-24
- 2026 年中国模型全景:DeepSeek V4、Kimi K3 等在列 — TheTuringPost · 2026-08-24
- 传闻 Claude Opus 6 泄露:上下文 250 万,推理更强 — iamaliveix · 2026-08-24