Intelligence Index v4.3 方法论更新:私有问题权重升至 45%
ArtificialAnlys · x · 2026-09-08
Artificial Analysis 公布 Intelligence Index v4.3 的方法论细节:
- 各类别权重维持不变:Agents 30%、Coding 20%、General 30%、Scientific Reasoning 20%
- Terminal-Bench 4.0 沿用 2.1 的权重,AutomationBench-AA 取代 𝜏³-Banking(占 5%)
- 使用私有问题/答案的评测占比从 v4.2 的 40% 升至 45%,以降低刷榜与数据污染的影响
完整榜单与方法论可在 Artificial Analysis 官网查看。
所属事件:Artificial Analysis 发布智能指数 v4.3,引入私有测试集(3 条相关)→
「模型」频道最新
- Spark-X2.5-4B GGUF 量化版登上 Hugging Face 热门 — XHToken · 2026-09-08
- Grok、Claude、ChatGPT 齐变「说教脸」,用户抱怨模型越来越爱纠错 — ionicfellow · 2026-09-08
- 开发者盘点 AI 竞赛格局:Fable 5.1 与 Astra 并列第一 — bindureddy · 2026-09-08
- Reddit 用户吐槽 Claude 回答变啰嗦:ChatGPT 现在更好用? — thermonuclear_icbm · 2026-09-08
- 实测称 Astra 浏览器操作能力不错,速度仍偏慢 — jobergum · 2026-09-08
- Codex 实用技巧:让 Astra 读取剩余额度百分比,用英语设预算跑长任务 — Dimillian · 2026-09-08