用户批 Claude Opus 名不副实:跑分虚高,实际使用令人抓狂
clarkesdirective · reddit · 2026-08-08
一位 Reddit 网友发帖表达了对 Claude Opus 模型的失望。该用户指出,尽管 Anthropic 员工极力夸赞其能力,但在实际使用中,Opus 处理任务极其缓慢且经常绕弯子。虽然它擅长发现自身错误,但如果不提前进行明确的规划和范围界定,体验往往令人抓狂。此外,用户表示该模型的表现让人对现有的 AI 基准测试产生严重不信任,认为其实际能力远不及跑分所暗示的水平。
所属事件:用户吐槽Claude Opus名不副实,跑分高但实际表现差(2 条相关)→
「模型」频道最新
- 反 AI 阵营的清醒发言:承认前沿模型已超越多数人类 — Regdit-is-Unbearable · 2026-08-08
- KOL 称 DeepSeek 是首个不撒谎的模型,暗讽 Claude 被过度对齐 — yacineMTB · 2026-08-08
- 开发者实测:DeepSeek 写移动端后台定位代码能力惊人 — haydendevs · 2026-08-08
- 分析称 AI 模型市场将三分天下,定制化开源模型潜力巨大 — ypatil125 · 2026-08-08
- DeepSeek 被指颠覆开发成本:极低定价催生自动化新范式 — GregKamradt · 2026-08-08
- 无工具辅助:Claude Opus 5 仅靠工作记忆完成 Base58 解码 — scrollaway · 2026-08-08