Zvi 深评 Claude Fable 5.1:缓存降价 75%、护栏误伤大减、全面好评
Don't Worry About the Vase (Zvi) · rss · 2026-09-06
Zvi 长文评测 Anthropic 新模型 Claude Fable 5.1,与 OpenAI 的 GPT-6 Astra 同期发布的罕见局面。
定价与策略
- 名义价格不变($10/M 输入、$50/M 输出),但缓存读取从 $1 降到 $0.25/M,典型用量便宜约 25%,高 agent 用量最高省约 45%(Claude Code 典型会话省 38%)。
- 推出零数据保留选项(客户自存数据),回应企业此前 30 天留存要求导致 Fable 5 在 Ramp 企业支出中仅占约 11% 的困境。
- 分类器误伤大幅减少:生物安全误拦截降 85%,Claude Code 每会话 cyber 拦截约减 60%。
能力与口碑
- Boris Cherny 称其为编码、数据分析、computer use 与长时 agent 工作的最佳模型;写作明显改进,Claude 腔减少,更主动、愿意消耗高 effort tokens 做有用的事。
- 官方跑分多为相对 Fable 5/Opus 5 的温和提升:HLE 57.8%/63.8%→60.9%/65%,Terminal-Bench-Science 24.7%→52.6%,CursorBench 3.2 上限 73.4%,FrontierSWE v2 0.57;ECI 162.0。个别高分 effort 下因「忍不住多做编辑」反而掉分。
- 社区反馈几乎全面正面,普遍认为 Fable 5.1 非常均衡。
格局判断:早期迹象(误差较大)显示 Sol→Astra 的跳跃可能大于 Fable 5→5.1;Zvi 自己打算两个模型「双持」,所有非平凡问题都问一遍。
「模型」频道最新
- Artificial Analysis 更新榜单方法,小幅修订致排名剧变引质疑 — solyarisoftware · 2026-09-06
- Astra 饱和空间推理基准,博主直呼「LLM 视觉已解决」 — lukaszkaiser · 2026-09-06
- Nvidia 携手 CrowdStrike 打造网络安全 AI 模型 — israelavila · 2026-09-06
- Plus 用户多模型分工工作流:ASTRA 只当架构师省额度 — KhaaliSeDin · 2026-09-06
- 阿里发布 Qwen-Drive-1.0-4B:4B 视觉语言模型瞄准自动驾驶场景理解 — solyarisoftware · 2026-09-06
- 实测打脸宣传:Astra 着色器生成竟不敌 GLM — teortaxesTex · 2026-09-06