用户批 Claude Opus 名不副实:跑分虚高,实际使用令人抓狂

clarkesdirective · reddit · 2026-08-08

一位 Reddit 网友发帖表达了对 Claude Opus 模型的失望。该用户指出,尽管 Anthropic 员工极力夸赞其能力,但在实际使用中,Opus 处理任务极其缓慢且经常绕弯子。虽然它擅长发现自身错误,但如果不提前进行明确的规划和范围界定,体验往往令人抓狂。此外,用户表示该模型的表现让人对现有的 AI 基准测试产生严重不信任,认为其实际能力远不及跑分所暗示的水平。

所属事件:用户吐槽Claude Opus名不副实,跑分高但实际表现差(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →