GPT-6.1 Sol 碾压 Opus 5.5?一条评测梗戳破基准崇拜
bigblueboo · x · 2026-10-01
博主 bigblueboo 引用一条宣称「OpenAI 内部基准显示 GPT-6.1 Sol 碾压 Claude Opus 5.5、Anthropic 难以追赶」的帖子,配文「Evals tell the tale…一切归结于那一个重要的指标」。帖中模型版本明显为虚构,实质是 AI 圈对「单指标评测定胜负」心态的调侃,属于梗图式内容而非真实爆料。
所属事件:OpenAI 内部基准称 GPT-6.1 Sol 大幅领先引质疑(2 条相关)→
「Fun」频道最新
- 手机上跑 Claude Code 让开发者直呼上瘾:走路都在写代码 — jdluk87 · 2026-10-01
- 反 AI 识别新招:故意把办公文档做得丑,证明没经过 AI — rickasaurus · 2026-10-01
- 三十年老画家:AI 恐慌是 Photoshop、3D 转型焦虑的重演 — dreamwieber · 2026-10-01
- rasbt 转述'播客爆料':OpenAI 决策 API 竟基于 GPT-6 Luna — rasbt · 2026-10-01
- 让 Grok 把自己放进超级马里奥,效果令人惊喜 — Baconbrix · 2026-10-01
- 从纪录片学开飞机劫机?网友调侃用 AI 学编程何罪之有 — _jaydeepkarale · 2026-10-01