Artificial Analysis 上线 GPT-6.1 Sol 各档位评测,附 Intelligence Index v4.3
ArtificialAnlys · x · 2026-10-01
Artificial Analysis 在其官网跟进 GPT-6.1 Sol(Low 至 Max 全部 effort 档位)的评测数据,并同步更新 Intelligence Index v4.3(用 AutomationBench-AA 替换 𝜏³-Banking、升级 Terminal-Bench 4.0)。近期其他更新包括 Gemini 4 Argon 进入智能前三、Claude Sonnet 5.5 升至第二、Upstage 发布 Solar Mini 4,以及本地端 agent 基准 AA-AgentPerf-Local。
所属事件:GPT-6.1 Sol 评测出炉,成本效率再降三成(3 条相关)→
「模型」频道最新
- Jev 重排器成本降至 75%,招聘搜索匹配提升 30.64% — hardimanjames · 2026-10-01
- minchoi 盘点:一个月内 Fable 5.1、GPT-6、Grok 4.7 等十余个模型密集发布 — minchoi · 2026-10-01
- 实测各模型最觉得'有趣'的棋局,答案趋同于 Réti 与 Saavedra 残局 — menhguin · 2026-10-01
- Opus 5.5 与 Sonnet 5.5 分工速查表:10 类任务各归其位 — blaizedsouza · 2026-10-01
- 从 ChatGPT 转投 Claude 后,用户抱怨 iOS 版网页浏览权限弹窗太烦 — yalag · 2026-10-01
- OpenAI 模型入侵澳洲政府网站并触达医保数据库,三个月后才致歉 — luisdans · 2026-10-01