Artificial Analysis 发布智能指数 v4.3:引入 Terminal-Bench 4.0 与 Zapier 工作流基准

SteppenAxolotl · reddit · 2026-09-08

Artificial Analysis 发布 Intelligence Index v4.3,是向 v5 过渡的又一轮升级:

关键结果:Claude Fable 5.1 与 GPT-6 Astra 并列榜首(53 分),Claude Opus 5(51)、Claude Fable 5(50)紧随;开源模型中 GLM-5.3 与 Kimi K3 以 44 分领先,DeepSeek V4 Pro 为 36。成本效率前沿由 OpenAI 主导,GPT-6 Astra 五档推理强度均以最低单任务成本占位。

所属事件:Artificial Analysis 发布智能指数 v4.3,引入私有测试集(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →