Claude Opus 5 在代码任务中识别出旧版漏掉的问题
PawelHuryn · x · 2026-07-25
这条回复讨论的是 Claude 在代码仓库里的实测表现:
- 贴主指出,这些问题并不是随机 bug,而是之前多轮 Claude Opus / Codex 会漏掉的内容,外加一些合成出来的类似案例。
- 具体体验是:它没有按“分析这个方案”去理解指令,反而先去看了 未提交改动;同时它还会做一些看似奇怪的动作,比如分析 git 历史,但这些步骤最后反而带来了意外的洞见。
- 贴主补充说,在自己用 Fable 5 和 Opus 4.8 跑了几十次 session 里,很多关键问题都被漏掉了,而 Opus 5 能识别出来。
所属事件:Bug实测:GPT-5.6修复22个bug领先Claude Opus 5(3 条相关)→
「编程与Agent」频道最新
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11