Opus 5.5 登顶写作榜:2631 Elo 领先 307 分,max 档一篇脚本 3.43 美元
OnlyProggingForFun · reddit · 2026-09-27
一个运行中的 AI 写作基准(167 个模型配置,10 个脚本任务×5 篇,三个实验室的 AI 评委盲评)公布 Claude Opus 5.5 以 2631 Elo 登顶,比第二名 Fable(2324)高出 307 分——该榜自 2026 年 6 月运行以来最大的单次跃升,也是首个在 rubric 上突破 91/100 的模型。
各 effort 档位表现:
- max:第 1,2600 Elo,但每篇脚本 $3.43、耗时 17 分钟,全榜最慢、价格前五
- xhigh:第 2,2399 Elo,$0.86、4.4 分钟——以约 1/4 价格领先上一代冠军近 100 Elo
- high:第 3,2342 Elo,$0.34、1.7 分钟,约 1/9 价格也胜过旧冠军
- medium:2199 Elo,$0.21;low:2144 Elo,$0.17
- 不传 effort flag 时 Opus 5.5 会自选档位,落在 medium 与 high 之间
作者结论:多数写作任务 high 是甜点位;要最好的初稿且等得起就用 max。旧冠军 Fable 5.1 max 为 2303 Elo、$3.15/篇。
「模型」频道最新
- 开发者实测 Opus 5.5:从给 AI 打工变回 AI 给我打工 — ezshine · 2026-09-27
- 让 Grok 教日文汉字,它却开始自创汉字 — JoeJustice · 2026-09-27
- GPT 智能体写出难以归类的短篇:《雨量计》全文引围观 — RileyRalmuto · 2026-09-27
- 谷歌 AI Studio 上线语音模型体验入口,可试新音频 API — ammaar · 2026-09-27
- 传言不实:Opus 4.5 未被削弱,一笔画出拜占庭式马赛克 — ctjlewis · 2026-09-27
- Opus 5.5 一次过生成全程序化 three.js 世界,成本约 60 美元 — EricBuess · 2026-09-27