开发者质疑 Meta Muse Spark 1.3 仅在跑分上好看,基准被严重操纵

bindureddy · x · 2026-09-03

开发者 Bindu Reddy 发推称 Meta 的 Muse Spark 1.3 只在基准测试上好看,实际体验只相当于 GPT 5.6 Terra 级别的模型,并断言「基准测试正在被严重操纵」。这是对当前模型刷榜文化的一致性质疑,属于未经证实的第三方评价,可作为观察评测与真实使用体验差距的参考。

所属事件:创业者质疑 Meta Muse Spark 1.3 跑分虚高(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →