评测榜洗牌:Meta 小模型 Muse Spark 力压 Astra DeepSwe
altryne · x · 2026-09-04
博主 altryne 观察到,如果说 OpenAI 赢下了当天,那么拿到第二名的其实是 Meta 而非 Anthropic、Google 或 xAI。Meta 的 Muse Spark 成绩超过了 Astra DeepSwe,而且其尚未发布的模型已经在 Artificial Analysis 排行上出现在更高位置(数据有些混乱)。值得注意的是,Spark 只是 Meta 的小模型,这暗示其未发布的大模型潜力更大。作者认为 AI 顶部的格局正在出现一次有趣的洗牌。
「模型」频道最新
- Martian:跨 44 个 LLM 路由可在 16 项基准上减少 46% 错误 — Arindam_1729 · 2026-09-04
- 前 OpenAI 安全副总裁:对 AI 进展不感到担忧就是误判形势 — Miles_Brundage · 2026-09-04
- Gary Marcus 评 GPT-6 Astra:符号世界模型是进步但远非 AGI — GaryMarcus · 2026-09-04
- Guillaume Verdon 判定 OpenAI「有点回归」,但真正考验是体感而非跑分 — beffjezos · 2026-09-04
- 神秘模型 Astra 在 FrontierMath T4 上超 5.6 Sol Pro — ctjlewis · 2026-09-04
- Inkling 模型免费开放推理,作者称将继续服务免费层用户 — simonguozirui · 2026-09-04