Fable 5.1 跑分性价比大跃升,Cursor Bench 超越 Sol 5.6 Max 且更便宜
kimmonismus · x · 2026-09-02
用户从跑分与性价比角度评价 Fable 5.1:在 Cursor Bench 中,Fable 5.1 High 表现明显优于 Sol 5.6 Max,且价格更低;在 Artificial Analysis 基准上也较前代显著提升。作者认为若新版本还能减少冗长输出、提升效率、降低误报拦截,将是一次出色的发布。
所属事件:Anthropic Fable 5.1 跑分登顶,成本争议再起(7 条相关)→
「模型」频道最新
- 李飞飞团队发布 Atlas:像素级相机控制世界模型 — viksit · 2026-09-02
- Fable 5.1 科研 Benchmark 解析:成功率翻倍至 53.6% — johnseach · 2026-09-02
- Anthropic 发布 Claude 5.1:成本降 25%,企业级隐私可用 — eugeneyan · 2026-09-02
- OpenAI 发布网络安全模型 Astra,达关键级阈值 — OpenAI · 2026-09-02
- 观察:AI 语音模式下回复变简洁,适应人类倾听习惯 — joshwhiton · 2026-09-02
- Anthropic 被指回溯为旧版 Opus 模型加强防护 — LordCoice · 2026-09-02