Claude Opus 5 编程好用,但把 Compound Engineering 搞坏了
danshipper · x · 2026-07-25
这条讲的是 Claude Opus 5 上手后的工程体验,而不是单纯的模型分数。
作者的结论是:
- 在中等强度的编码场景里,Opus 5 很好用,但前提是别过度依赖复杂 skills 和超长 prompt。
- 但放进 Compound Engineering 这种自治工作流里,它会频繁把控制权还给用户,破坏原本的 agent 流程。
- 团队因此开始 重写 Compound Engineering,去适配新模型行为。
- 作者还放出了一个用于重新调优 harness/plugin 的自定义 skill。
这条的重点是:不是模型单独变强了,而是整套 agent 工程栈可能都得跟着重构。
所属事件:Claude Opus 5 早期实测:效率提升但行为过度主动(29 条相关)→
「编程与Agent」频道最新
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11
- 开源 Agent Skill 2.3k 星:生成 MVP 蓝图并审计重构 agentic harness — tom_doerr · 2026-09-11