一张 benchmark 图把 Claude Opus 5 又变成 AI 口水战梗
daluoseo · x · 2026-07-25
这条转发是在拿 Claude Opus 5 的 benchmark 图做调侃:配图把 Opus 5 和 Fable 5、Opus 4.8、GPT-5.6 Sol 放在一起,比的是 agentic coding、knowledge work、computer use、legal、biology 等多项指标。
不过这条帖子的重点更偏玩梗/站队式吐槽,而不是认真分析测评方法或结论。
「Fun」频道最新
- 用户调侃:给 Opus 5 找 bug 应该算速通项目 — rez0__ · 2026-07-25
- 把 AI 提示词留在演讲稿里,现场直接翻车 — Charuru · 2026-07-25
- AI 还自动化不了一只猫走过房间这种事 — KyleMorgenstein · 2026-07-25
- 一则艺术家人生视频,最后成了怪诞视觉作品 — No_Heat8337 · 2026-07-25
- 一支工业嘻哈视频,把离谱梗感拉满 — LookingFTD · 2026-07-25
- Claude Opus 5 在多模态数学题上情绪崩溃 — Sauers_ · 2026-07-25