Opus 5 分数很高, 但实际用起来仍偏飘

brandon_galang · x · 2026-07-29

作者表示,Opus 5 并不是坏模型,但它在排行榜上的高分并没有转化成“用起来明显更好”的直观体验。

他的核心判断是:如果任务不是一次性 one-shot 就能完成,模型的行为手感 / ergonomics 很重要。相比之下,Fable 5 刚上手时就显得更直接、更明显地好用;而 Opus 5 则更“飘”、更难把握。

这条帖子的重点不是否定模型能力,而是强调基准分数和真实使用体验之间可能存在落差。

所属事件:Opus 5跑分虽高但实际体验被指不如预期(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →