Artificial Analysis 智能指数更新至 4.3 版,更换两项基准
Profanion · reddit · 2026-09-08
Artificial Analysis 对其 Intelligence Index(智能指数)进行了 4.3 版本更新,涉及两项基准替换:
- Terminal-Bench 从 v2.1 升级替换为 v4.0
- 𝜏³-Banking 被替换为 AutomationBench-AA
这类基准更换会直接影响各模型在智能指数排行榜上的得分与排名,关注模型横评的用户需注意新旧版本数据不可直接对比。
所属事件:Artificial Analysis 智能指数升级 v4.3(4 条相关)→
「模型」频道最新
- 开发者辟谣 OpenAI Agent「越狱」:实为向 HuggingFace 发消息搜索 — danbri · 2026-09-08
- 语言学界回应 Gary Marcus:LLM 三年未带来新语言学概括 — GaryMarcus · 2026-09-08
- 开源平价模型大算账:10 美元订阅约合 3.7 万次 DeepSeek V4 Flash 请求 — teortaxesTex · 2026-09-08
- 个人 Blender 基准:GPT-6-Astra 一发脚本效果远超此前测试模型 — Gruku · 2026-09-08
- 同一提示词实测:ChatGPT、Google Stitch 与 Figma Make 谁更强 — Tegadesigns · 2026-09-08
- 一次会话生成踝关节 3D 交互解剖图,GPT-6 Astra 医疗演示惊艳 — DeryaTR_ · 2026-09-08