旗舰更贵未必更值:GPT-6 Astra 与 Claude Fable 5.1 单任务成本翻倍
arena · x · 2026-09-17
AI 竞技场按「净改进分」和「每任务中位成本」对比各家模型家族的旗舰版本。
- OpenAI:GPT-6 Astra (Max) 净改进 +11.7%,$3.94/任务;GPT-5.6 Sol (xHigh) +7.0%,仅 $1.03/任务
- Anthropic:Claude Fable 5.1 (Max) +13.7%,$4.40/任务;Claude Opus 5 (High) +10.2%,$2.07/任务
结论:GPT-6 Astra 和 Claude Fable 5.1 表现突出,但两者成本远高于同厂其他模型,性能提升却相对有限,旗舰档性价比存疑。
所属事件:Agent Arena 成本榜:GPT-6 Astra 更贵未必更值(2 条相关)→
「模型」频道最新
- GPT-6 命名科普:Astra 只是版本分层,不是所谓 GPT-6 本体 — flowersslop · 2026-09-17
- 「开放权重」≠ 开源:斯坦福 HAI 指出 AI 行业最爱的标签正引发争议 — StanfordHAI · 2026-09-17
- 「判断模型」Jev 想做快而便宜的决策,或重塑商业自动化 — The AI Daily Brief · 2026-09-17
- 未开源细节引猜测:并行解码与 LLM 结构化输出有何不同 — ricklamers · 2026-09-17
- fx 安全分类器实测:比 GPT-5.6-Luna 快 5-18 倍且更准 — cramforce · 2026-09-17
- 小米 MiMo-V2.6 正在 RL 训练中:每步约 20 亿 token、多环境智能体 RL — bodonoghue85 · 2026-09-17