数据对比引争议 Sonnet 5.5 被评失败发布
Reddit 用户与博主 haider1 依据 Artificial Analysis 数据对比同价($2/$10 每百万 token)的 GPT-6 Sol 与 Claude Sonnet 5.5,发现 GPT-6 Sol 每美元得分更高,单任务成本差异明显;Sonnet 5.5 在 medium 推理档得分与定价上不占优,且输出更啰嗦,被批评为一次糟糕的发布,不过也有观点认为其上限更强。
2026-09-29 ~ 2026-09-30 · 2 条相关
- 第 1 集:爆料称 OpenAI 与 Anthropic 内部模型领先公开发布版(2026-09-24,2 条)
- 第 2 集:传 Anthropic 将赶在 OpenAI DevDay 前发布 Claude 5.5(2026-09-26,2 条)
- 第 3 集:Claude Sonnet 5.5 泄露:灰度已开、发布倒计时(2026-09-27,20 条)
- 第 4 集:爆料称 OpenAI 手握更强模型却压着不发(2026-09-28,2 条)
- 第 5 集:传 Anthropic DevDay 前夕突袭发 Opus 5.5 与 Sonnet 5.5(2026-09-29,7 条)
- 第 6 集:Anthropic 发布 Claude Sonnet 5.5:快 30%、多数任务成本降三成(2026-09-29,58 条)
- 第 7 集:Claude Sonnet 5.5 发布:智能逼近 Opus,但成 token 效率争议焦点(2026-09-29,27 条)
- 第 8 集:多方爆料称 Claude Sonnet 5.5 跑分碾压 GPT-6 sol(2026-09-29,5 条)
- 第 9 集:数据对比引争议 Sonnet 5.5 被评失败发布(2026-09-29,2 条)
- 同价对比:GPT-6 Sol 每美元得分更高,Sonnet 5.5 上限更强 — AMBNNJ · 2026-09-29
- 数据对比显示 Sonnet 5.5 更贵更啰嗦,被称一次失败发布 — haider1 · 2026-09-30