Claude Fable 5.1 发布:科研基准翻倍,解数据留存
dotey · x · 2026-09-02
Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1,两者为同一模型但安全限制不同。Fable 5.1 面向大众,Mythos 5.1 仅面向特定研究人员。
核心升级:
- 科研能力:在 Terminal-Bench-Science 0.1 上得分 52.6%(前代 24.7%),实现翻倍。
- 编程能力:Terminal-Bench 4.0 得分 55.8%(Mythos 版 60.9%),超越 Opus 5。
- 自动化:AutomationBench 得分从 17.1% 提升至 31.4%。
- 企业数据:提供数据留存争议的解决方案(零数据保留)。
- 成本:价格下降(具体见评测)。
实战案例:投资公司 Millennium 用 Fable 5.1 找到了困扰工程师数年的系统崩溃根因。
所属事件:Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1:缓存降价 75%,Agent 能力大涨(17 条相关)→
「模型」频道最新
- Perplexity 接入 Claude Fable 5.1,成本降 37% — perplexity_ai · 2026-09-02
- Anthropic Fable 5.1 系统提示词泄露,长达 27 万字符 — Scobleizer · 2026-09-02
- Fable 5.1 模型集成 Anthropic 统计文本水印 — RaGE_Syria · 2026-09-02
- 多智能体评测缺乏模型间对比,需更多细节 — scaling01 · 2026-09-02
- Fable 5.1 跑分超 GPT-5.6,成本仅六成 — haider1 · 2026-09-02
- 疑 Claude Fable 5.1 增加过多指令,似过度对齐 — teodorio · 2026-09-02