Meta发布MuseSpark 1.3反超Gemini,汪滔贴脸开大「Gemini who?」
智东西 · wechat · 2026-09-03
在谷歌发布 Gemini 3.8 Flash 仅 4 小时后,Meta 发布新旗舰模型 MuseSpark 1.3,在 Artificial Analysis 智能指数上以 62 分反超 Gemini 的 59 分,仅次于 Claude Fable 5.1(66 分)和 Claude Opus 5(63 分)。Meta 首席 AI 官汪滔(Alexandr Wang)在 X 上调侃谷歌「gemini who?」。这是 Meta 五个月内发布的第四款 MuseSpark 模型,官方还预告将开源模型权重。
新模型主打长上下文与编程:与 Claude Code+Opus5 组合搭配 MuseCode 的表现相当;相比 1.2 版,工具调用减少 20%、token 消耗减少 25%,多步骤任务中更好地保留细节约束,对抗鲁棒性与提示注入防御也有升级。定价与 1.2 持平:输入 1.25 美元/百万 token(缓存未命中)、输出 4.25 美元/百万 token,比 DeepSeek-V4-Pro 高峰期还便宜。
开发者实测口碑分化:速度快、成本低但生成效果不算惊艳。有开发者用 10 美分做出《我的世界》;另一个 Ultra 模式案例在 2 小时内跑了 20 轮自我优化循环、60 多次智能体任务,总成本不到 1 美元。但在 MineBench 3D 空间推理测试中,其成本是 Gemini 3.8 Flash 的 5.6 倍、耗时更长且首测得分更低,Agent 能力也是相对短板。
所属事件:Meta 发布 Muse Spark 1.3:性能对标 Fable 5,价格仅约八分之一(53 条相关)→
「模型」频道最新
- Codex 后端现 GPT-6 Astra 与 Astra Aeon 曝光,后者或为长时程 Agent — VraserX · 2026-09-03
- 蚂蚁集团开源金融增强模型Ling-3.0-flash-Fin,124B参数 — niacolhealth · 2026-09-03
- 博主提议:用'解决难题数量'作为新模型能力基准 — Dr_Singularity · 2026-09-03
- Ben Thompson 发文喊话 Gemini:成败在此一举 — kieranklaassen · 2026-09-03
- 用户称ChatGPT突然输出“GOD IS COMING”且无法停止 — jaypro1005 · 2026-09-03
- Ling-3.0-flash-Fin 开源发布:124B 参数仅激活 5.1B — Bestlife73 · 2026-09-03