Grok 4.6 在工程科学领域追平 GPT-5.6 Sol

sanmikoyejo · x · 2026-08-28

不同模型在科学领域的表现存在差异。Anthropic 和 OpenAI 的最佳模型在大多数领域占据主导,但在工程科学领域,SpaceX 的 Grok 4.6 以更低的成本和 Token 用量与 GPT-5.6 Sol 并列第二(14.8%)。Opus 5 在除数学科学外的所有领域排名第一,而在数学领域 Fable 5(33.3%)和 Sol(31.4%)领先。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →