GPT-6.1 Sol 碾压 Opus 5.5?一条评测梗戳破基准崇拜

bigblueboo · x · 2026-10-01

博主 bigblueboo 引用一条宣称「OpenAI 内部基准显示 GPT-6.1 Sol 碾压 Claude Opus 5.5、Anthropic 难以追赶」的帖子,配文「Evals tell the tale…一切归结于那一个重要的指标」。帖中模型版本明显为虚构,实质是 AI 圈对「单指标评测定胜负」心态的调侃,属于梗图式内容而非真实爆料。

所属事件:OpenAI 内部基准称 GPT-6.1 Sol 大幅领先引质疑(2 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →