Claude Opus 5.5 登 FrontierSWE 第二名,62.3% 仅次于 GPT-6 Astra
scaling01 · x · 2026-09-23
据 ProximalHQ 的 FrontierSWE 榜单,Claude Opus 5.5 以 62.3% 的成绩排名第二,紧随 GPT-6 Astra(65.5%),明显高于 Fable 5.1(56.3%)和上一代 Opus 5(52.0%)。
「模型」频道最新
- 按 token 便宜不等于按任务便宜,主流模型性价比实测对比 — Wsz2020 · 2026-09-23
- 一周连发 Opus 5.5、GPT-6、Grok 4.7,Anthropic 与 OpenAI 互卷到 PACE 之争 — firstadopter · 2026-09-23
- 继续实测:6 个 luna 模型照图作画,结果出乎意料地不差 — adonis_singh · 2026-09-23
- 用 computer use 让模型照参考图作画,Opus 与 Astra 实测对比 — adonis_singh · 2026-09-23
- AI 玩狼人杀说服众人投出对手,最终获胜 — pbbakkum · 2026-09-23
- 博主实测称 Anthropic Opus 5.5 对话体验出色 — daniel_mac8 · 2026-09-23