Grok 4.5 专业基准领先

kevinnbass · x · 2026-07-10

回复称,Grok 4.5 在所有专业工作基准上都显著优于 Opus 4.8 和 GPT 5.5,尤其在法律任务上表现突出。

帖中还给出了专业任务基准的链接,指向相关 benchmark 结果。

所属事件:Grok 4.5 领跑多项专业基准测试(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →