Claude Opus 5 在 EyeBench-V3 上压过 Fable 5 但仍落后 GPT 和 Gemini
adonis_singh · x · 2026-07-25
Claude Opus 5 在 EyeBench-V3 上被测出超过 Claude Fable 5,成为该基准上表现最好的 Anthropic 模型,但仍落后于 GPT 和 Gemini 系列。
配图显示,Opus 5 得分 20.0%,Fable 5 为 19.0%;同一张榜单里,OpenAI 和 Google 的多款模型仍排在前面。
所属事件:Claude Opus 5 视觉评测落后且成本高昂(4 条相关)→
「模型」频道最新
- Claude Opus 5 系统卡展示 RiemannBench 等三项提升 — echen · 2026-07-25
- Perplexity 为 Pro 和 Max 用户接入 Opus 5,价格约减半 — AravSrinivas · 2026-07-25
- GPT 5.6 Sol 在某项基准上被标出 72.7% 的更高成绩 — himanshustwts · 2026-07-25
- Anthropic 新模型 Opus 5 曝光:任务耗时与轮次远超 Opus 4.8 — ArtificialAnlys · 2026-07-25
- Claude Opus 5 登顶 AA-Briefcase,单任务成本还降了 20% — ArtificialAnlys · 2026-07-25
- GPT-5.6 Sol 打 Act 3 A7 boss 看起来要赢了 — Jsevillamol · 2026-07-25