模型排行榜竞争加速
testingcatalog · x · 2026-07-11
本周 @arena 和 @ArtificialAnlys 的排行榜出现了近来最大幅度的变化之一。前两家实验室仍稳居前列,但 Grok 和 Muse Spark 的提升很明显,对 Gemini 和 GLM 形成了压力;不过它们与第一梯队之间的差距仍然不小。
帖子强调,智能提升的速度正在变得越来越重要:现在不只是“冲到榜首一次”,而是要持续快速迭代,才能维持竞争力。
作者还观察到,模型发布节奏正在加快,似乎在为“持续学习”打基础。如果这一趋势延续,未来排行榜甚至可能走向更高频更新。过去已经从季度发布走到月度发布,作者提出:双周发布会不会在年底前成为常态?
「模型」频道最新
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11
- giffmana 补充:环境用于训练正是他要说的重点 — giffmana · 2026-09-11
- 开源 LLM 排行榜与定价对照目录,一站式索引比较工具 — Last_Establishment_1 · 2026-09-11
- Anthropic 称已尽力让评测环境不可被模型识别 — MaxKannen · 2026-09-11
- Nex N2.5 Pro 开源发布,权重体积达 407GB — jinnyjuice · 2026-09-11
- RoMa v2 图像匹配模型发布,作者晒出黑底宣传图 — ducha_aiki · 2026-09-11