Claude Opus 5 视觉评测落后且成本高昂
在 EyeBench-V3 基准测试中,Claude Opus 5 虽然超越了同门的 Fable 5 成为 Anthropic 表现最好的模型,但整体性能依然落后于 GPT 和 Gemini。成本方面,尽管 Opus 5 的运行成本比 Fable 5 低约 14%,但其输出极为冗长,生成的 Token 数量约为后者 2.5 倍,导致单任务成本逼近 GPT 5.6 Sol 的两倍。
2026-07-25 ~ 2026-07-25 · 4 条相关
- 第 1 集:Claude Opus 5 曝光:多榜单综合登顶成新 SOTA(2026-07-25,6 条)
- 第 2 集:Opus 5 与 GPT-5.6 Sol 实测:能力趋同,成本与风格成选型关键(2026-07-25,7 条)
- 第 3 集:Claude Opus 5 视觉评测落后且成本高昂(2026-07-25,4 条)
- Claude Opus 5 在 EyeBench-V3 上压过 Fable 5 但仍落后 GPT 和 Gemini — adonis_singh · 2026-07-25
- Opus 5 在 EyeBench-V3 上比 Fable 5 便宜 14%,却多输出 2.5 倍 token — adonis_singh · 2026-07-25
- 实测 Opus 与 Fable 成本:输出冗长致费用逼近 — adonis_singh · 2026-07-25
- 图表显示 Claude Opus 5 单任务成本约为 GPT 5.6 Sol 的两倍 — soumitrashukla9 · 2026-07-25