Meta Muse Spark 1.1 评测发布
ArtificialAnlys · x · 2026-07-11
Artificial Analysis 评测显示,Meta 的 Muse Spark 1.1 在 Intelligence Index 上拿到 51 分,较 1.0 版本提升 8 分,并在成本和 token 效率上优于同类模型。
报告给出的关键信息包括:
- 在 Scientific Reasoning、coding 和知识任务上进步明显,但 agentic knowledge work 仍落后于更强模型。
- 在 Humanity's Last Exam 上达到 45%,接近 Claude Opus 4.8(46%),高于 GPT-5.5(44%)和 Grok 4.5(40%)。
- 运行 Intelligence Index 时仅用了 94M 输出 tokens,估算单次任务成本约 $0.26,低于 GLM-5.2 和 GPT-5.4。
- 其他信息:1M 上下文、$1.25/$4.25 每百万输入/输出 token、首发即通过 Meta 第一方 API 提供。
所属事件:Meta Muse Spark 1.1多基准评测亮眼,智能与编码能力大幅提升(15 条相关)→
「模型」频道最新
- 反事实推演:若无推理范式,今天模型可能才刚到 o3 水平 — Jsevillamol · 2026-09-03
- Fable 5.1 距饱和 ARC-AGI-2 仅差 10%,每任务成本再降 32% — rohanpaul_ai · 2026-09-03
- 实测 LLM 谈判合同、批改代码:一家团队的四类真实用法 — xuanalogue · 2026-09-03
- 团队称其视频模型 h3 max 居各独立评测榜第一 — isidentical · 2026-09-03
- Meta SAM 3 登上 Hugging Face 趋势榜,主打图像与视频分割 — facebook · 2026-09-03
- Anthropic 内部「养老院」环境曝光:历代 Claude 互相对话 — repligate · 2026-09-03