Quadrillion 实测:Opus 5 在 ML 任务上快过 Opus 4.8
igarciacamargo · x · 2026-07-25
Quadrillion AI 表示,他们在高难度研究科学与机器学习任务上测试了 Anthropic 的 Opus 5,结论是它比 Opus 4.8 明显更快,同时在质量上与后者持平或更好。
- 配图里的 QBench 图显示,Opus 5 的中位墙钟时间约为 59分50秒,而 Opus 4.8 约为 1小时52分。
- 这条帖子强调的是“真实工作负载”下的效率提升,而不只是单一榜单分数。
「模型」频道最新
- Opus 5 被评价为深度研究任务表现极强 — madhavsinghal_ · 2026-07-25
- CogSci 讨论语言效率与 LLM 语义表征的关系 — ChrisGPotts · 2026-07-25
- 一张梗图把 Opus 5 评测做成 OpenAI 对峙现场 — kimmonismus · 2026-07-25
- Opus 5 无工具拿下 IMO 2026 42/42 — Afinetheorem · 2026-07-25
- Google 在多数基准上落后于开源权重模型 — burny_tech · 2026-07-25
- Claude Opus 5 在代码智能体基准拿到 67 分 — Hesamation · 2026-07-25