一张 benchmark 图把 Claude Opus 5 又变成 AI 口水战梗

daluoseo · x · 2026-07-25

这条转发是在拿 Claude Opus 5 的 benchmark 图做调侃:配图把 Opus 5 和 Fable 5、Opus 4.8、GPT-5.6 Sol 放在一起,比的是 agentic coding、knowledge work、computer use、legal、biology 等多项指标。

不过这条帖子的重点更偏玩梗/站队式吐槽,而不是认真分析测评方法或结论。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →