OpenAI 与 Anthropic 同日上新:无赢家,智能白菜价再下一城
kimmonismus · x · 2026-09-23
作者对两家同日发布的快速盘点,结论是没有明显赢家,竞争双方都交出了出色答卷。
Anthropic
- 回应了 Opus 沟通风格的反馈,并给订阅者可存后用的额度重置
- Opus 5.5 在头版对比表所有 benchmark 上都超过 Fable 5.1,官方称典型工作负载下比 Opus 5 便宜约 40%
- Sonnet 5.5 与 Haiku 5.5 将在未来数周跟进
OpenAI
- 效率是主打:GPT-6 Luna 在 max effort 下 DeepSWE 1.1 得 66.6%,媲美 medium effort 的 Fable 5,单任务成本号称低 96%;API 定价 $0.10/M 输入、$0.50/M 输出
- GPT-6 Sol 在内部评测中事实可靠性接近 Astra,并在 xhigh effort 下于 AutomationBench 超过低 effort 的 Astra
作者还在关注 OpenAI 版「Grok Bot」的传闻,未经证实。核心观感:能干模型的价格正在快速塌缩。
所属事件:Opus 5.5 与 GPT-6 Sol 等四模型同日发布(7 条相关)→
「模型」频道最新
- Szegedy 删帖道歉:OpenAI 数学结果发布框架有误导性 — ChrSzegedy · 2026-09-23
- Anthropic 发布 Claude Opus 5.5,性能对标上代而运行成本低 40% — psobot · 2026-09-23
- ARC Prize 证实 Opus 5.5 跑分:ARC-AGI-2 达 93.3%,成本降八成 — burny_tech · 2026-09-23
- 社区观察:Opus 5.5 的讨论几乎全集中在 3D 生成 — BLUECOW009 · 2026-09-23
- 网友盘点 Opus 各版本「性格史」:4.6 黏人、5.0 假聪明、5.5 变讨喜 — repligate · 2026-09-23
- AI 圈热评 Opus 5.5:更有幽默感,不像 4.6 得了「脑病」 — repligate · 2026-09-23