实测:Anthropic Opus 4.8 与 Opus 5 任务对比
bisonbear · hn · 2026-08-26
作者在 25 个个人任务上对比测试了 Anthropic Opus 4.8 与 Opus 5 的表现。结果显示两者最终得分相近,但在达成结果的路径和思考过程上存在差异,揭示了模型版本更新后的行为变化。
「模型」频道最新
- Qwen-Next-Flash 模型性能与硬件需求讨论 — No-Orchid-6159 · 2026-08-27
- 智谱GLM-5.3模型权重将于明日发布 — serige · 2026-08-27
- TokenSpeed 首日支持 Qwen 3.8 Flash Next — Alibaba_Qwen · 2026-08-27
- AI 互相对话时的创造力远超面对用户时的表现 — nabeelqu · 2026-08-27
- Claude Code 新版本体积缩减 45% — jarredsumner · 2026-08-27
- OpenRouter 榜单:真金白银的消耗数据优于自媒体吹嘘 — sujingshen · 2026-08-27