GSO 最新榜单出炉
scaling01 · x · 2026-07-13
GSO 的最新结果出来了,榜单显示:
- Opus 4.8 排到 新 SOTA
- GPT-5.5-xhigh 排名第 4
- Sonnet 5 排名第 5
这是一条纯粹的模型排行/基准更新信息,核心看点是新一轮模型在 GSO 上的相对位置变化。
所属事件:GSO最新榜单出炉,Opus 4.8登顶新SOTA(2 条相关)→
「模型」频道最新
- 新基准一出分数暴跌 70 点:「刷榜」现象如何让跑分失真 — airesearch12 · 2026-09-11
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11
- 网友称 DeepSeek 4.1 Flash 是语言模型历史拐点(未证实) — himanshustwts · 2026-09-11