创业者质疑 Meta Muse Spark 1.3 跑分虚高
连续创业者 Bindu Reddy 发推公开质疑 Meta 新模型 Muse Spark 1.3,称其只在基准测试上表现好看,实际使用体验仅相当于 GPT-5.6 Terra 级别,并断言基准测试正被严重操纵。该批评引发社区对当前 AI 模型跑分与真实能力脱节的讨论。
2026-09-03 ~ 2026-09-03 · 2 条相关
- 开发者质疑 Meta Muse Spark 1.3 仅在跑分上好看,基准被严重操纵 — bindureddy · 2026-09-03
- 创始人质疑 Meta Muse Spark 1.3:跑分好但实际仅 GPT-5.6 Terra 级 — bindureddy · 2026-09-03