Meta MuseSpark1.3 发布:与Fable5打平,Token消耗降25%
量子位 · wechat · 2026-09-03
Meta 于 9 月 2 日发布 MuseSpark1.3,这是该系列今年 4 月以来的第四个版本。ArtificialAnalysis 榜单上,MuseSpark1.3 Max 得分 62,与 Fable5、5.1 xhigh 持平;在 Coding 与 Agent 细项上已超越综合分更高的 Opus5 max。
- 效率提升:相比 1.2 平均减少约 20% 工具调用、25% Token 消耗,长程任务更能记住初始要求。扎克伯格称性能提升大到「便宜得没必要算账」。
- 实测:同 Prompt 生成自包含 HTML 的 3D 维京手办,1.3 花费 0.1 美元但细节明显更好;另一测试中 1.3 Ultra Contributor 在「Judge 打分不到 9.5 不准停」规则下连续跑 20 轮自我改进、启动 60+ 次 Agent,总花费不到 1 美元。
- 价格不变:输入 1.25 美元/百万 Token,输出 4.25 美元/百万,缓存输入 0.15 美元。ArtificialAnalysis 估算 1.3 xhigh 每个任务约 0.55 美元,低于 GPT-5.6 Sol Max(约 0.95)和 Grok4.6 High(约 0.94)。
- 团队交作业:核心研究员赵晟佳称其为 Spark 系列最强 Coding/Agent 模型;毕树平披露训练阶段加大算力做结果评分矫正,针对偷懒划水、奖励黑客等问题,可用性明显提升。
MuseSpark 后续还将开放权重,更大的 Muse 系列模型也在路上。
「模型」频道最新
- 753B 模型思考、4B 模型执笔:潜空间通信让推理快 20 倍,登顶 ARC-AGI — TheMoonMidas · 2026-09-03
- Meta Muse Spark 1.3 免费上架 OpenCode — ramagetime · 2026-09-03
- DeepLoop 论文让循环 Transformer 可稳定扩展,并传前沿模型为 48 层循环两次 — StartupYou · 2026-09-03
- 爆料称 OpenAI 隐藏大模型 Bel 年底登场,Astra 仍在 Agent-1 阶段 — haider1 · 2026-09-03
- Reddit 用户实测 Gemini 3.8 Flash:花更多功夫,结果却差不多 — Correct_Tomato1871 · 2026-09-03
- 2x3090 跑 Qwen3.8-Flash-Next:expert cache 把解码从 17 提到 25-29 t/s — Extension-Bid-639 · 2026-09-03