Reddit 用户反驳 Opus 5.5 遭降智论:发布当天就在引入 bug
japt77 · reddit · 2026-10-02
针对社区再起的「Opus 5.5 上线后被削弱(nerf)」讨论,作者提出反驳:所谓「发布当天零失误」的说法本身就不成立,模型在他自己的用例里从发布起就会引入 bug——这不是模型变笨,而是软件开发中需求遗漏、逻辑不完整、边界用例等固有问题的体现。
他的核心观点:
- 用「能否一次性跑通 prompt」来评判编码模型很荒谬,应该用功能测试来度量和验证模型输出,即便不会写代码也可以学会给 Claude 写测试。
- 糟糕的使用体验里往往有大量「用户错误」:prompt 怎么写的、CLAUDE.md 是否覆盖了用例、自己对问题本身理解多深。
- 他自己观察到的性能大体没变,不相信发生过 nerf。
作者最后感叹 AI 让人变懒、变得理所当然,尤其大家多用它做永远不会有结果的业余项目。
所属事件:Opus 5.5 疑遭暗削引热议,社区各方观点分歧(4 条相关)→
「模型」频道最新
- GLM 5.3 登陆 Cursor,Max 版登顶 CursorBench 4.0 开源模型榜首 — zainhas · 2026-10-02
- Anthropic 封号潮下 200 刀订阅难退款,网友求退款攻略 — lxfater · 2026-10-02
- RSI-Exam 榜单:Claude Opus 5.5 以 0.536 登顶力压 GPT-6 — HuaxiuYaoML · 2026-10-02
- Opus 5.5 降价反证「降智旧款」论:但服务成本降 40% 存疑 — maier_ak · 2026-10-02
- 同一厂商自评自家模型:Opus 5.5 基准数据能信几分 — maier_ak · 2026-10-02
- 微调开源模型改名闭源成新套路,ostris 质疑排行网站合作 — ostrisai · 2026-10-02