o1 之后 OpenAI 的基准图被做成了梗,GPT-5 和 o3 都上榜

willdepue · x · 2026-07-22

这条帖在吐槽 OpenAI 的设计团队在 o1 之后“突然失常”,开始做出配图里这种风格的图表。

图里是典型的 OpenAI 风格基准图:一张是 SWE-bench Verified 上 GPT-5、o3、GPT-4o 的对比,另一张是 Humanity’s Last Exam 的多学科成绩柱状图。整条帖子的笑点在于:这些图既像正式发布材料,又像被拿来反向做梗图。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →