GPT-6 Astra 对比 Claude Fable 5.1:互有胜负同价
DataLearnerAI · reddit · 2026-09-04
作者汇总了目前能找到的 GPT-6 Astra 与 Claude Fable 5.1 公开基准数据,结论是局面胶着,尚不足以判定谁整体更强。
- GPT-6 Astra 在多个已发表的编程、科学与 agent 基准上领先,包括 Terminal-Bench 和 DeepSWE
- Claude Fable 5.1 在部分独立评测中更好:Artificial Analysis 给了它更高的 Intelligence Index 和 Coding Agent Index
- 编程 agent 对比受周边 harness 影响很大,不是纯粹的模型对模型测试
- 两者 API 定价相同:$10/M 输入、$50/M 输出,但缓存与长上下文定价有差异
作者整理了对比页面,并期待更多真实使用对比。
「模型」频道最新
- Martian:跨 44 个 LLM 路由可在 16 项基准上减少 46% 错误 — Arindam_1729 · 2026-09-04
- 前 OpenAI 安全副总裁:对 AI 进展不感到担忧就是误判形势 — Miles_Brundage · 2026-09-04
- Gary Marcus 评 GPT-6 Astra:符号世界模型是进步但远非 AGI — GaryMarcus · 2026-09-04
- Guillaume Verdon 判定 OpenAI「有点回归」,但真正考验是体感而非跑分 — beffjezos · 2026-09-04
- 神秘模型 Astra 在 FrontierMath T4 上超 5.6 Sol Pro — ctjlewis · 2026-09-04
- Inkling 模型免费开放推理,作者称将继续服务免费层用户 — simonguozirui · 2026-09-04