Anthropic 新模型 Opus 5 曝光:任务耗时与轮次远超 Opus 4.8
ArtificialAnlys · x · 2026-07-25
据 Artificial Analysis 评测数据,近期曝光的 Claude Opus 5 在高算力设置下处理复杂任务的时间显著增加。
- 耗时更长:在 max、xhigh 和 high 三档最高努力设置下,Opus 5 平均每项任务耗时分别为 36.2、34.3 和 25.7 分钟。
- 对比前代:在 max 努力级别下,其耗时比 Opus 4.8(24.1 分钟)长约 50%。
- 轮次增加:耗时拉长的主要原因是推理轮次的急剧增加。Opus 5 在前三档设置下平均需要 103、91 和 76 个轮次,而 Opus 4.8 仅为 55 个。
「模型」频道最新
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11
- 网友称 DeepSeek 4.1 Flash 是语言模型历史拐点(未证实) — himanshustwts · 2026-09-11
- Terminal Bench v4 榜单:GLM-5.3 以 41.9% 一骑绝尘 — Ok_Warning2146 · 2026-09-11