Muse Spark 1.1 在 Text Arena 跑到 1495 分,性价比很突出
ycombinator · x · 2026-07-22
这篇 Reddit 分析认为,Muse Spark 1.1 可能是当前最被低估的前沿模型之一。它在 Text Arena 上大约是 1495 ±8,因为投票数更少所以不确定性更高,但作者认为它真正的亮点在于 agentic coding 表现和极低价格:按 100 万输入/输出 token 计算大约只要 $1.25 / $4.25。帖子还提到,Arena 已把它放到 性价比帕累托前沿 上,而 LiveBench 里它在 agentic coding 上也很强,不过并不意味着它就是所有任务的最佳模型。
「模型」频道最新
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11
- 网友称 DeepSeek 4.1 Flash 是语言模型历史拐点(未证实) — himanshustwts · 2026-09-11
- Terminal Bench v4 榜单:GLM-5.3 以 41.9% 一骑绝尘 — Ok_Warning2146 · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11