开发者不解:Claude 为何在真实编码体验上持续压过资源更多的巨头
FactorGeneral4078 · reddit · 2026-09-23
Reddit 用户发帖讨论:为什么 Anthropic 资源远少于 Google、OpenAI、Meta,但 Claude 在真实世界编码和技术工作中仍明显更好用。
- 作者以最新 Opus 为例,认为优势不在基准测试成绩,而在模型「理解需求、梳理代码库、产出深思熟虑的代码」的体感
- 提出猜测:可能是 post-training 阶段特别擅长把模型调到开发者期望的行为方式
- 帖子引发社区对 Anthropic 训练/对齐方法差异化原因的讨论
「模型」频道最新
- Beff Jezos 调侃 Opus 5.5 告别 slop 文风,读者大脑减负 — beffjezos · 2026-09-23
- Opus 5.5 一次生成完整波斯王子关卡,音画俱全 — iannuttall · 2026-09-23
- GPT-6 Sol 在 DeepSWE 上反输前代:72.7% 对 68.8% — banaxi-tech · 2026-09-23
- 模型发布疲劳:开发者称新模型提升边际化,够用就好 — Rasmic · 2026-09-23
- 评测者补充:Opus 5.5 与 Astra、Fable 5.1 大致同一档,无明确胜者 — AaronBergman18 · 2026-09-23
- 评测者称 Opus 5.5 综合或为最聪明模型,知识面略逊于对手 — AaronBergman18 · 2026-09-23