资深开发者实测:Claude Opus 5 擅长单次任务,处理复杂项目易翻车

markusn42 · reddit · 2026-08-14

一位资深软件工程师发帖分享了对 Claude Opus 5 的使用观察。他一直觉得 Opus 系列在处理已有的大型代码库时表现糟糕,尤其是面对技术债务和冲突文档时常常让人崩溃。

但他最近在一个全新的空白项目(带有一定复杂度的 Chrome 扩展爬虫工具)中测试发现,Opus 5 在高推理模式下表现极佳:单次会话就完成了 17 次 commit,自主搭建了仓库架构,最终产出的可用代码也通过了 Codex 的对抗性审查。

他由此提出疑问:Opus 5 是否特别不擅长处理历史包袱重的复杂工程,却非常擅长从零开始的“一次性”任务?他认为目前的基准测试可能忽略了这一维度。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →