GDPval-AA 榜单:Opus 5.5 中档胜 GPT-6 最高档,成本低约 80%
nicolechirps · x · 2026-09-23
一则模型对比推文称,在 GDPval-AA 评测上,Claude Opus 5.5 在 medium 档位的表现超过 GPT-6 Astra 的最高档设置。
按单任务估算成本:
- Opus 5.5:约 $0.85
- GPT-6 Astra:约 $4.50
结论是 Opus 5.5 分数更高,同时成本低约 80%。原帖附有截图佐证,但未说明评测样本与统计细节,具体分数以截图为准。
所属事件:Opus 5.5 发布:评测胜 GPT-6 Astra 且便宜六成(4 条相关)→
「模型」频道最新
- 内部人士初体验疑似 Opus 5.5:能力强但「不像 Opus 的感觉」 — repligate · 2026-09-23
- Artificial Analysis 发布 AA-Omniscience:仅 3 个模型不比瞎猜更易幻觉 — geoffwolfe · 2026-09-23
- Anthropic 发布 Claude Opus 5.5:多数任务对标 Fable 5.1,成本降 40% — jyangballin · 2026-09-23
- Szegedy 删帖道歉:OpenAI 数学结果发布框架有误导性 — ChrSzegedy · 2026-09-23
- Scale AI 携 Meta 推出 Muse,登顶 App Store 并霸榜 PRBench — alexandr_wang · 2026-09-23
- ARC Prize 证实 Opus 5.5 跑分:ARC-AGI-2 达 93.3%,成本降八成 — burny_tech · 2026-09-23