用户实测一周后吐槽 Claude:过度谨慎、自设障碍,不如 ChatGPT
Redstra · reddit · 2026-10-02
一位用户在 Reddit 发帖称认真使用 Claude 一周后无法理解其好评,认为它「极度死板、过度谨慎」:
- 求职场景:给出职位描述请其协助申请,Claude 直接以「你不符合硬性要求,我不会帮你填任何内容」终止任务;相同输入下 ChatGPT 同样指出硬性要求,但会分析哪些部分仍可合理论证、如何不造假地推进申请
- 报销案例:给齐全套上下文后,Claude 凭空要求「三位家庭成员书面授权」才能处理部分索赔,实际经办人认为是无稽之谈
- 3D 设计:做带邮票槽的相册架,两模型初版都错,ChatGPT 能按反馈修正,Claude 却把槽移到了背面
作者在指令中明确要求「寻找可能性而非直接阻止」仍无效。结论:Claude 能力强但常过度思考、虚构不必要的障碍并自信执行;在理解意图、迭代修正上 ChatGPT 更好。评论区引发关于模型过度对齐的讨论。
「模型」频道最新
- 每月 400 美元买哪个 Agent?网友提议让它们同城对抗实测 — nick_linck · 2026-10-02
- fastino 发布 GLiDE:首个按需思考的决策模型,Decision Index 登顶 — kalyan_kpl · 2026-10-02
- Anthropic 自述:从 Sonnet 5 的「难聊」到 Fable 5.1 找回经典 Claude 手感 — every · 2026-10-02
- 1565 封邮件实测:Perplexity 与 Cloudflare 决策模型比拼 — michellechen · 2026-10-02
- 两张 96GB 昇腾卡本地跑 Qwen:从 1 tok/s 调到 30 tok/s 全记录 — matteiuspi · 2026-10-02
- ChatGPT 暴力内容审查过严,虚构故事也频繁触发改写 — CrispyIsHere · 2026-10-02