编程 Pareto 前沿仅剩 Muse Spark 1.3 与 Fable 5.1
jyangballin · x · 2026-09-11
- EdwardSun0909 分享的编程基准对比图显示,只有 Muse Spark 1.3 和 Fable 5.1 位于编程能力-成本的 Pareto 前沿上。
- leerob 确认 Grok 4.6 的分数偏低是准确的对比结果,并预告 Grok 4.7 即将发布。
「模型」频道最新
- Genspark 发布 Gen-1 Slides:价格仅 Opus 5 的 1/17 — Scobleizer · 2026-09-11
- 传 OpenAI 内部模型 Bel 攻克三大千禧年难题, hype 空前 — imadade · 2026-09-11
- DeepSeek-V4.1-Flash 上线 Ollama 云端,Pro 订阅用户已可使用 — ollama · 2026-09-11
- GPT-6 Astra 被指是计算机操作模型,专为知识工作而生 — mckbrando · 2026-09-11
- Sakana AI 发布 Fugu Max 与 Fugu Ultra v2:动态编排逼近旗舰、成本降 2-6 倍 — SakanaAILabs · 2026-09-11
- ChatGPT 全面 NSFW 还有戏吗?用户实测 Astra 模型硬拒绝 — Dogbold · 2026-09-11