Meta新模型Muse Spark 1.2评测:数学能力超GPT-5.5,略逊Kimi K3

alexandr_wang · x · 2026-08-08

据ErdosBench评测,Meta新模型Muse Spark 1.2在226道研究级数学题中解出40道,表现优于GPT-5.5 xhigh,略逊于Kimi K3。该模型证明卫生良好,B级评审产出高,无强主张被拒,但A级闭合较少。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →