Claude Opus 5.5 登顶写作榜,2631 Elo领先第二名307分创纪录
teortaxesTex · x · 2026-09-24
AI 写作基准运营方 WhatsAI 称 Claude Opus 5.5 以 2631 Elo 登顶其写作排行榜,大幅拉开与第二名 Fable(2324)的差距——307 分是该榜单自 2026 年 6 月创办以来最大的单次跃升,运营方一度以为是 bug。它也是首个在 rubric 上突破 91/100 的模型。
代价同样惊人:在最高 effort 档,写一个脚本需 17 分钟、花费 3.43 美元,是整个榜单上最慢的配置,费用也位居前五。原帖作者 teortaxes 评论称,Anthropic 明明一直有能力修复(此前写作方面)的问题,只是不够在意。
「模型」频道最新
- Google 开放模型 Gemma 4 上线 Antigravity SDK,开发者可直接调用 — sachinmaya1980 · 2026-09-24
- Toby Ord:RL 能规模化到今天,部分答案在中期训练 — tobyordoxford · 2026-09-24
- Domingos:参差不齐的智能,是会割伤人的 — pmddomingos · 2026-09-24
- NVIDIA 发布 Nemotron 3 说话人分离模型,支持 8 人重叠语音 — andimarafioti · 2026-09-24
- Signal65 实测:Opus 5.5 加权错误减半、单价降三成,前沿模型价格战开打 — ryanshrout · 2026-09-24
- 博主盛赞 Opus 5.5:几周卡住的 bug 它轻松搞定 — repligate · 2026-09-24