Opus 5实测翻车:频繁自我怀疑与能力降级引吐槽
近期 Opus 5 在真实场景实测中遭到多名用户吐槽,普遍反映其存在频繁自我怀疑、基础能力下降、指令遵循变差等问题,整体体验不如前代模型。
已确认
综合多名用户的实际测试反馈,Opus 5 暴露出以下具体问题:
- 过度自我纠错:@Aizkmusic 指出该模型技术上虽强,但每隔几秒就会自我怀疑并不断进行修正。@whatsallthiss 也提到,在要求其重新思考核心假设时,模型经常陷入自我矛盾。
- 基础能力出错:@whatsallthiss 报告称,模型在基础热力学常识上胡说八道,并频频算错简单的数学题。
- 指令遵循变差:@springrod 反馈,看不出 Opus 5 相比 4.8 版本有明显优势,反而出现了更多错误,且更不听从指令。
- 操作异常:@TurnTrout 记录了模型在近一天内回复令人困惑且错误频发,最具体的翻车记录是据说至少三次误删了 /dev/null。@orange 也早早发现了模型存在异常行为并怀疑是 bug。
为什么重要
作为备受期待的新版本模型,Opus 5 在真实场景下的频繁翻车直接影响了用户体验。多位发帖者(如 @springrod 和 @Aizkmusic)明确表示,相比 Opus 5,他们更倾向于使用之前的 4.8 或 4.5 版本。这些来自一线的真实负面反馈,引发了社区对于新模型是否出现严重能力降级的广泛质疑。
2026-07-25 ~ 2026-07-27 · 5 条相关
一手来源
- 用户吐槽 Opus 5 能力严重降级:满嘴胡言还算错题 — whatsallthiss ·
- 用户称 Opus 5 在实测中多次误删 /dev/null — Turn_Trout ·
- 有用户称 Opus 5 比 4.8 更易出错、也更不听话 — springrod ·
- Opus 5 实测出现异常,发帖者怀疑有 bug — oran_ge · 2026-07-25
- 【源头】用户称 Opus 5 在实测中多次误删 /dev/null — Turn_Trout · 2026-07-26
- 【源头】用户吐槽 Opus 5 能力严重降级:满嘴胡言还算错题 — whatsallthiss · 2026-07-27
- 【源头】有用户称 Opus 5 比 4.8 更易出错、也更不听话 — springrod · 2026-07-27
- Opus 5 技术强但总在自我怀疑 — Aizkmusic · 2026-07-27