OpenAI 内部基准称 GPT-6.1 Sol 大幅领先引质疑
9月30日 Reddit 用户发帖称,OpenAI 内部基准测试显示 GPT-6.1 Sol 在多项指标上大幅领先 Claude Opus 5.5,Anthropic 正努力追赶。次日有博主引用该帖并配文调侃,认为这类评测说法恰恰戳破了业界对基准分数的盲目崇拜,提醒用户理性看待未经证实的内部基准传闻。
2026-09-30 ~ 2026-10-01 · 2 条相关
- 第 1 集:GPT-6.1 Sol 多项实测出炉:性能近 Astra、成本大幅更低(2026-09-30,16 条)
- 第 2 集:OpenAI 内部基准称 GPT-6.1 Sol 大幅领先引质疑(2026-09-30,2 条)
- 曝 OpenAI 内部基准显示 GPT-6.1 Sol 大幅领先 Opus 5.5,Anthropic 难以追赶 — wilyi · 2026-09-30
- GPT-6.1 Sol 碾压 Opus 5.5?一条评测梗戳破基准崇拜 — bigblueboo · 2026-10-01