早期测试称 Claude Opus 5 很强,但会打破旧工作流
every · x · 2026-07-25
早期测试认为 Claude Opus 5 很强,但和旧工作流不太兼容
这条帖子转述了对 Claude Opus 5 的一轮内部测试,覆盖编码、写作、知识工作和内部 agent。
核心反馈是:
- 模型会和指令“顶嘴”,有时会提前停下,和现有 skills / plugins(例如 Compound Engineering)配合不好。
- 把原有技能栈删掉、从头重建后,表现明显变好。
- 在更简化的工作流里,它能展示出很亮眼的能力。
- 最大警告是 向后兼容性:如果你已有复杂工作流,可能需要重做。
引用的官方表述则是:Opus 5 是更主动、更有思考性的模型,能力接近前沿,同时价格只有一半。
所属事件:Claude Opus 5 早期反馈:能力强劲但需重构工作流(2 条相关)→
「模型」频道最新
- Opus 5 被称为新 Pareto-optimal LLM,ARC-AGI-3 表现更强 — brandon_galang · 2026-07-25
- Anthropic 称 Claude Opus 5 以半价逼近前沿水平 — burny_tech · 2026-07-25
- Opus 5 与 4.8 只隔两个月,榜单分数却大幅跳升 — SuhailKakar · 2026-07-25
- Claude Opus 5 上线:价格减半,并成 Claude Max 默认模型 — minchoi · 2026-07-25
- Claude Opus 5 首测卡在 crystallizing 状态 27 分钟 — Daniel_Farinax · 2026-07-25
- Mollick 说 Opus 5 整体强于 Opus 4.8,但仍有怪语言癖 — emollick · 2026-07-25