OpenAI 内部基准称 GPT-6.1 Sol 大幅领先引质疑

9月30日 Reddit 用户发帖称,OpenAI 内部基准测试显示 GPT-6.1 Sol 在多项指标上大幅领先 Claude Opus 5.5,Anthropic 正努力追赶。次日有博主引用该帖并配文调侃,认为这类评测说法恰恰戳破了业界对基准分数的盲目崇拜,提醒用户理性看待未经证实的内部基准传闻。

2026-09-30 ~ 2026-10-01 · 2 条相关

事件全程(共 2 集)→