ethanCaballero 质疑:GPT-6 Astra 为何在 AA 指数上被压制
ethanCaballero · x · 2026-09-04
AI 研究者 Ethan Caballero 对 GPT-6 Astra 提出质疑:为什么它在 AA(Artificial Analysis)指数上表现不佳?这与第三方「几乎全面胜过 Fable 5.1」的说法形成张力,提示该模型在不同评测口径下表现可能不一致。
所属事件:GPT-6 Astra 第三方榜单表现遭社区集中质疑(6 条相关)→
「模型」频道最新
- OpenAI Astra 可自动布局与布线 PCB,工程师热议影响 — MikePFrank · 2026-09-04
- Ethan Mollick 实测 Astra:给它模糊需求,它自己拆任务就开干 — emollick · 2026-09-04
- 「AGI is 74% deepswe」:GPT-6-Astra 榜单成绩刷屏成梗 — amaarora · 2026-09-04
- 曝 Grok 4.7 数日内发布,据称用 SpaceX 工程数据补充训练 — XFreeze · 2026-09-04
- 前 OpenAI 安全副总裁:对 AI 进展不感到担忧就是误判形势 — Miles_Brundage · 2026-09-04
- Gary Marcus 评 GPT-6 Astra:符号世界模型是进步但远非 AGI — GaryMarcus · 2026-09-04