开发者质疑 Claude 评测亮眼却暗藏怪癖
一位开发者发布长文质疑 Claude Opus 5 等新模型「评测成绩很好,但实际使用体验诡异」:模型总在过度行事,比如读文件、干活、反复检查,像需要保姆式看护,用户仍要精心写 prompt 并核对输出。他怀疑这些怪癖是 Anthropic 在后训练阶段引入的,追问「怪癖」是否被直接训进了模型,引发社区讨论。
2026-09-13 ~ 2026-09-14 · 2 条相关
- 长文追问:Anthropic 是否把「怪癖」训进了 Claude? — MaziyarPanahi · 2026-09-13
- 博主吐槽 Claude 评测很好用起来诡异,疑后训练引入怪癖 — MaziyarPanahi · 2026-09-14