Claude 在自家 harness 中表现反逊第三方工具
开发者发现,Claude 模型在 Anthropic 官方的 Claude Code(CC)测试框架中的表现,反而不如在 opencode、cursor 等第三方工具中出色。这一反常现象在社区引发热议——同一模型在自家 harness 里不如在第三方客户端里好用,可能涉及提示词、工具调用或评测环境差异,也让外界重新审视官方 benchmark 与真实开发体验之间的落差。
2026-07-20 ~ 2026-07-20 · 2 条相关
- Claude模型在不同编码工具中表现差异引热议 — ZainHasan6 · 2026-07-20
- Claude 在自家 harness 中表现不如第三方 — ZainHasan6 · 2026-07-20