第三方基准显示 Astra 与 Sol 持平,未超 Opus、Fable、Spark
stoicismftw · reddit · 2026-09-04
Reddit 用户根据 Artificial Analysis 的综合基准指出,OpenAI 的 Astra(max)成绩低于 Anthropic Opus、以及 Fable 和 Spark,并与 Sol(max)完全打平。
- 这意味着在 AA 综合基准上 Astra 相对 Sol「几乎没有提升」
- 与 OpenAI 自己发布的基准表现形成反差
- 作者认为如果社区转向信任 AA 数据而非厂商自选基准,对 OpenAI 相当不利
注意:属第三方基准解读,非官方结论。
所属事件:GPT-6 Astra 第三方榜单表现遭社区集中质疑(6 条相关)→
「模型」频道最新
- OpenAI Astra 可自动布局与布线 PCB,工程师热议影响 — MikePFrank · 2026-09-04
- Ethan Mollick 实测 Astra:给它模糊需求,它自己拆任务就开干 — emollick · 2026-09-04
- 「AGI is 74% deepswe」:GPT-6-Astra 榜单成绩刷屏成梗 — amaarora · 2026-09-04
- 曝 Grok 4.7 数日内发布,据称用 SpaceX 工程数据补充训练 — XFreeze · 2026-09-04
- 前 OpenAI 安全副总裁:对 AI 进展不感到担忧就是误判形势 — Miles_Brundage · 2026-09-04
- Gary Marcus 评 GPT-6 Astra:符号世界模型是进步但远非 AGI — GaryMarcus · 2026-09-04