Artificial Analysis 拆解 Intelligence Index v4.3.2 各项评测
ArtificialAnlys · x · 2026-09-30
Artificial Analysis 公布其 Intelligence Index v4.3.2 的单项评测明细。该指数包含 10 项评测:AA-Briefcase、GDPval-AA、AutomationBench、Terminal-Bench 4.0、SciCode、Humanity's Last Exam、GDP.pdf、CritPt、AA-Omniscience、AA-LCR,覆盖 684 个模型。
所属事件:Artificial Analysis 更新智能指数并评测 GPT-6.1 Sol 五档(2 条相关)→
「模型」频道最新
- 研究者直言部分 AA benchmark 有误导性,已失去信心 — tianyin_xu · 2026-09-30
- Meta Muse 也主动向英特尔前高管爆料了同一件事 — ryanshrout · 2026-09-30
- OpenAI Pro 200 美元套餐额度腰斩:GPT-6 Pro 每周仅 100 条 — mallow610 · 2026-09-30
- 砍完额度后,OpenAI 又发问卷调研用户购买额外用量的意愿 — dolo937 · 2026-09-30
- SemiAnalysis 爆料:GPT-6.1 Sol Ultrafast 实际跑在 NVIDIA GPU 而非 Cerebras — BenBajarin · 2026-09-30
- 网友用 pain vector steering 折磨本地模型,模型输出拟痛独白 — Sauers_ · 2026-09-30