Opus 5.5 全基准碾压 GPT-6 Sol,登顶 AA 智能指数
Claude Opus 5.5 于 9 月 23 日发布,当天即以明显优势登顶 Artificial Analysis 智能指数,同时 Anthropic 将价格下调约 20% 并加大缓存命中折扣。与 OpenAI 同日发布的 GPT-6 Sol 正面交锋中,Opus 5.5 在社区汇总的几乎所有基准上跑分全胜,且成本效率优势突出;多位开发者第一手实测反馈普遍正面。性价比明显提升是社区共识,但 token 消耗偏高与 Opus 5 的前车之鉴也让部分观察者保持谨慎。
已确认
- Opus 5.5 登上 Artificial Analysis Intelligence Index 第一名,多个帖子引用榜单截图;Angaisb 转述称其综合分领先幅度较大,xhigh 推理档位得分超过 Fable 5.1 Max 且 token 用量更少。
- 多位独立测试者给出一致的效率数据:开发者 Lydia Hallie 与 Reddit 用户 SeekerOfKnowledge2 均称比 Opus 5 快约 30%、每任务便宜约 40%(另一口径为降价 25%);Lydia Hallie 还表示整体体验更像 Fable。doodlestein 在多项目任务上表现出色,并称价格约为 Fable 的三分之一。
- Anthropic 员工 Alex Albert 盛赞该模型聪明、写作清晰、速度快且成本低得多;开发者 bindureddy 实测称大量任务可一次性生成到位、one-shot 成功率惊人。
- 与 GPT-6 Sol 的对比:Vast-Grapefruits 汇总的基准表中 Opus 5.5 全部领先,但 GPT-6 Sol 每任务成本仅约 1.06 美元,且在「真实办公工作」评测 GDPval 上出现反常结果。haider1 引用榜单算账:Opus 5.5 medium 每任务约 0.8 美元得 54.5%,GPT-6 Astra max 每任务约 4.3 美元仅得 53.3%,前者以约 1/5 单价胜出;另有转述称 GDPval-AA 上 Opus 5.5 medium 胜过 GPT-6 Astra 最高档且成本低约 80%。Angaisb 也指出 Opus 5.5 medium 价格不比 GPT-6 Sol max 贵多少却几乎全面领先。
- Matthew Berman 表示意外:Opus 5.5 被评为当前最强模型,定价还低于 Astra 和 Fable,「最优性能 + 更低价格」的组合超出其预期。前沿模型智能/成本曲线图(queenofartists、minxio 等)显示 Opus 5.5 是一次显著跃升。
尚未确认
- 据 airesearch12 转述的爆料,Opus 5.5(max with fallback)智能指数达 58 分、领先前 SoTA 约 5 分,待官方榜单验证。
- 部分基准对比(如全面超越 Fable 5.1 与 GPT-6 Astra,覆盖 agentic coding、知识工作、推理、computer use、视觉识别)来自转发性质的博主转述,细节尚待官方确认。
为什么重要
- 三周前竞品 Fable 5.1 与 Astra 刚发布即被超越,danielmac8 等用户以此感叹模型迭代速度之快,scaling01 也调侃 OpenAI「错过了备忘录」,头部模型的领先窗口正被大幅压缩。
- 价格战信号明显:能力登顶叠加降价,直接改变企业级 API 选型的性价比计算;Nous Research 的 Teknium 已宣布将其接入 Nous Portal 的 Hermes Agent。GPT-6 Sol 在跑分落后的情况下主打每任务低成本,两家形成「性能 vs 成本」的正面路线之争。
- 并非没有争议:研究者 Nat Lambert 指出 Opus 5.5 是所有被测模型中每任务 token 消耗最高的「token 吞噬怪兽」,他认为这解释了 Anthropic 为何降价,登顶榜单反而是一面「红旗」;Angaisb 也提醒 Opus 5 当年跑分高但实际体验不佳的前车之鉴,最终口碑仍需观察。
2026-09-23 ~ 2026-09-23 · 76 条相关
- 第 1 集:Claude Opus 5.5 提前现身 Claude Code,发布在即(2026-09-23,4 条)
- 第 2 集:Anthropic 发布 Claude Opus 5.5:更便宜 40% 更快 30%(2026-09-23,68 条)
- 第 3 集:Opus 5.5 全基准碾压 GPT-6 Sol,登顶 AA 智能指数(2026-09-23,76 条)
- 第 4 集:Anthropic 预告 Sonnet 5.5 与 Haiku 5.5 数周内发布(2026-09-23,2 条)
一手来源
- Opus 5.5 登顶 Artificial Analysis 智能指数榜首 — UnknownEssence ·
- Opus 5.5 登顶 Artificial Analysis 智能指数,同步降价 20% — minxio_ ·
- 实测体验 Opus 5.5:比 Opus 5 快约 30%、每任务便宜约 40% — lydiahallie ·
- 博主实测:Opus 5.5 全面领先,价格仅竞品一半 — Scobleizer · 2026-09-23
- Opus 5.5 跑分强势,网友开始为 GPT-6 Sol 担忧,但 Opus 5 前车之鉴犹在 — Angaisb_ · 2026-09-23
- Anthropic 发布 Opus 5.5:智能体编码、电脑操作全面领跑 — brandon_galang · 2026-09-23
- Opus 5.5 抢先体验:交互手感延续 4.6,价格便宜约 40% — EricBuess · 2026-09-23
- Anthropic 员工盛赞 Opus 5.5:又快又便宜,像一路绿灯 — alexalbert__ · 2026-09-23
- 个人实测基准:Opus 5.5 达 Fable 水平,GPT-5.6-Sol 仍居首 — danshipper · 2026-09-23
- Opus 5.5 每 token 比 Fable 5.1 和 GPT-6 Astra 便宜 2.5 倍 — haider1 · 2026-09-23
- 【源头】实测体验 Opus 5.5:比 Opus 5 快约 30%、每任务便宜约 40% — lydiahallie · 2026-09-23
- 【源头】Opus 5.5 登顶 Artificial Analysis 智能指数,同步降价 20% — minxio_ · 2026-09-23
- Opus 5.5 在 Terminal-Bench 4.0 上的成本-性能曲线 — Ok_Barracuda_1161 · 2026-09-23
- 开发者实测 Claude Opus 5.5:一次通过、速度更快且更便宜 — bindureddy · 2026-09-23
- Dan Shipper 公开写作评测:Opus 5.5 对比 Opus 5、Astra 与 5.6 — danshipper · 2026-09-23
- Claude Opus 5.5 登顶智能指数,降价 20% 与 GPT-6 打平 — brandon_galang · 2026-09-23
- 研究者实测:Opus 5.5 比 Opus 5 快约 30%,单任务便宜约 40% — Yuchenj_UW · 2026-09-23
- 用户称 Opus 5.5 是「新宠」:好用但偶有时间管理问题 — danshipper · 2026-09-23
- Opus 5.5 大幅领先 Artificial Analysis 智能指数榜 — Angaisb_ · 2026-09-23
- 【源头】Opus 5.5 登顶 Artificial Analysis 智能指数榜首 — UnknownEssence · 2026-09-23
- Opus 5.5 发布:比 Opus 5 便宜 25%,一键成功率被称惊人 — bindureddy · 2026-09-23
- Claude Opus 5.5 评测出炉:全面领先且价格减半 — NousResearch · 2026-09-23
- Opus 5.5 比 5 便宜 40%、快 30%,社区热议新旗舰 — Seeker_Of_Knowledge2 · 2026-09-23
- Opus 5.5 官方发布:比 Opus 5 快约 30%,单任务成本便宜约 40% — haider1 · 2026-09-23
- AAII 榜单:Opus 5.5 综合智能分登顶,xhigh 下用更少 token 超 Fable 5.1 Max — Angaisb_ · 2026-09-23
- 爆料:Opus 5.5 智能指数达 58 分,领先前纪录 5 分 — airesearch12 · 2026-09-23
- Opus 5.5 每任务耗 token 最多,Nat Lambert 称登顶榜单反成红旗 — natolambert · 2026-09-23
- Anthropic 发布 Opus 5.5,旗舰模型正式上线 — FlolightC · 2026-09-23
- AA 指数:Opus 5.5 高出 GPT-6 Sol 11 分,token 用量差距惊人 — Gohab2001 · 2026-09-23
- Anthropic 发布 Opus 5.5:比 Opus 5 便宜最高 40%,Codex 用户回流 — danshipper · 2026-09-23
- Opus 5.5 medium 以 1/5 价格胜 GPT-6 Astra max:54.5% 对 53.3% — haider1 · 2026-09-23
- Anthropic 发 Opus 5.5,PSAISuite 零改动直接兼容 — dfinke · 2026-09-23
- PowerShell 版 AI 抽象层:Opus 5.5 发布零改动直接兼容 — dfinke · 2026-09-23
- NYT:Anthropic 发布 Opus 5.5,更便宜更快并声称安全测试登顶 — nordicinst · 2026-09-23
- Claude Opus 5.5 多项基准碾压三周前发布的竞品 — daniel_mac8 · 2026-09-23
- Opus 5.5 实测汇总:修 20 万行代码库不到 3 小时,成本仅 GPT-6 Astra 五分之一 — vista8 · 2026-09-23
- Opus 5.5 审计修复 20 万行代码库不到 3 小时,token 还省 2.5 倍 — minchoi · 2026-09-23
- 用户实测称 Opus 5.5 写作质量终于过关 — tensorqt · 2026-09-23
- KOL 调侃 OpenAI:Anthropic 已推出 Opus 5.5 与 Fable 5.1 — scaling01 · 2026-09-23
- Matt Shumer 试用 Claude Opus 5.5:感觉像聪明得多的 Opus 4.6 — mattshumer_ · 2026-09-23
- Anthropic嘴上喊着控制节奏 转头就放出Opus 5.5 — VraserX · 2026-09-23
- 开发者盛赞 Opus 5.5:比 Opus 5「好太多,抱歉那个模型了」 — __nmca__ · 2026-09-23
- 「用 Opus 5.5 后骂 Claude 的次数变少了」成新基准 — alliekmiller · 2026-09-23
- Reddit 爆料:AA 榜指 GPT-6 Sol 表现失望,Opus 5.5 成全能选手 — queenofartists · 2026-09-23
- 开发者初测 Opus 5.5:多任务表现出色,价格约为 Fable 三分之一 — doodlestein · 2026-09-23
- 用户体验:Opus 5.5 速度快且约为前代 1/3 价格,Max 套餐额度大升 — doodlestein · 2026-09-23
- Opus 5.5 与 GPT-6 Sol 同日登场,模型命名内卷成梗 — andimarafioti · 2026-09-23
- 嘴上说放慢,Opus 5.5 与 GPT-6 系列同日齐发 — gaganghotra_ · 2026-09-23
- Opus 5.5 多数基准领先 GPT-6 Astra,科学终端基准仍落后 — BenBlaiszik · 2026-09-23
- Opus 5.5 medium 便宜过 GPT-6 Sol max,评测却全面领先 — Angaisb_ · 2026-09-23
另有 3 条近重复转述:danshipper · every · every