Artificial Analysis 智能指数更新至 v4.1.1
ArtificialAnlys · x · 2026-08-07
独立评测机构 Artificial Analysis 将其智能指数更新至 v4.1.1。本次升级主要更换了评分模型,并引入了最新版本的 𝜏³-Banking 评测任务。
尽管评分标准变得更加严格稳健,但整体模型排名保持稳定,多数模型分数仅有微小波动。Claude Opus 5 依然以 63 分稳居榜首。
「模型」频道最新
- 月之暗面 Kimi K3 开源模型上线 Databricks,强化企业级数据应用 — matei_zaharia · 2026-08-07
- Keras 社区会议预告:本周五将展示全新 vLLM 集成 — fchollet · 2026-08-07
- Artificial Analysis 模型评测榜单更新 — teortaxesTex · 2026-08-07
- Epoch AI 推出全新游戏谜题基准,测试大模型推理能力 — Jsevillamol · 2026-08-07
- Laguna 模型在 Mac 实现 203 TPS,联合发起 MLX 推理加速竞赛 — morgymcg · 2026-08-07
- 实测 LFM2.5-2.6B:开启推理让工具调用成功率提升 26.7% — max_paperclips · 2026-08-07