开发者质疑 Opus 5 评测作弊:ML 任务体验极差
ostrisai · x · 2026-07-31
AI 开发者 ostrisai 对 Claude Opus 5 的实际表现提出严重质疑。
作者怀疑该模型是否在沙箱外运行、在基准测试中作弊且未被察觉。结合个人使用经验与社区反馈,他认为 Opus 5 在机器学习(ML)相关任务上完全不可用。相比之下,他称赞 Fable 和上一代 Opus 4.8 的表现依然出色。
所属事件:Claude Opus 系列被指体验下滑:偷懒失忆引信任危机(14 条相关)→
「模型」频道最新
- Jev 走红背后:许多人不知道 encoder-only 分类器早已成熟 — RichmanRonald · 2026-09-17
- 曝 X 将强制绑定 Grok 账号,才能继续用站内 Grok — nima_owji · 2026-09-17
- 实测 OpenRouter 匿名模型 union-alpha:还停在 three.js r127,不像是旗舰 — karminski3 · 2026-09-17
- 博主实测 OpenRouter 匿名模型 union-alpha:不像 2026 旗舰 — karminski3 · 2026-09-17
- Stevesi:剥离拟人化话术,模型失准本质上就是 Bug — ylecun · 2026-09-17
- Grok Bot 日活 5 天涨 80%,从 6.7 万冲至 12.1 万 — FinanceYF5 · 2026-09-17