GPT-6 Astra 引质疑后,Artificial Analysis 改版 Intelligence Index
The Decoder · rss · 2026-09-06
评测机构 Artificial Analysis 发布了 Intelligence Index v4.2,被外界认为是对「榜单未能反映 GPT-6 Astra 真实进步」这一质疑的回应。
改版后 Astra 比前代高出 4 分,但仍落后于 Anthropic 的 Claude Fable 5.1。此次改版凸显了第三方榜单与前沿模型实际能力之间的测量争议。
「模型」频道最新
- Benchwarmer 工具用 Bad Apple 重制 AI 跑分图,自动纠正误导性图表 — aronchick · 2026-09-06
- 程序员数月未写一行代码:Eleanor Berger 详解 GPT-6 Astra 的"工厂模式" — intellectronica · 2026-09-06
- 开发者在车里用 Astra 一次成文:盼了两年的体验终于落地 — generativist · 2026-09-06
- GPT-6 Astra 被评最强视觉模型,Gemini 或遭赶超 — jonstephens85 · 2026-09-06
- 开发者称 Codex OAuth 终于修复 100 万上下文 — menhguin · 2026-09-06
- 爆料:Grok Bot 已入驻约 100 家客户,销售团队下周启动内部培训 — Sauers_ · 2026-09-06