用户汇总 Claude Opus 5 六大槽点:跑分最强却最难用
gerardsans · x · 2026-08-20
网友 @Ananth7e 整理了对 Claude Opus 5 的一致性抱怨:极度啰嗦、过度道歉和摇摆、不断与指令争辩、自造怪异措辞、做过头停不下来、引入能通过测试的隐蔽 bug、自信地犯错还把修复搞砸,日常体验不如 Opus 4.8。但它在前端、UI 和 3D 方面依然出色。结论是「benchmark 上最好,实际共事最差」。引用此帖的 @gerardsans 则认为这标志着纯粹依靠 scaling 的路线撞墙:跑分飙升但日常不可用,用户开始退订跳船。
所属事件:Claude Opus 5 遭用户集体吐槽引发退订潮(4 条相关)→
「模型」频道最新
- 研究称大模型后期训练导致语言新颖但缺乏实用性 — TuhinChakr · 2026-08-20
- Grok 4.6 实测口碑:用户称已 100% 接管 Codex 的编码工作 — CedricMakes · 2026-08-20
- Grok 4.6 评测分析:法律与经济指标领先,编程未占优 — ChrisGPT · 2026-08-20
- 国内大厂客户端系统提示词泄露:三层记忆与 MCP 路由 — vista8 · 2026-08-20
- 测试发现 Base 模型补全内容可继承提示词的 AI/人写特征 — AaronBergman18 · 2026-08-20
- 预测中国年底登顶榜单几率仅一成 — Polymarket · 2026-08-20