专题 · FULL STORY

Claude Fable 5.1:从泄露线索到实测验证

9 月初,Claude Fable 5.1 疑似现身 Bedrock 与官方文档,发布传闻四起;9 月 2 日 Anthropic 正式官宣 Fable 5.1 与 Mythos 5.1,缓存成本大降 75%;随后 Every 等团队实测显示其编码能力登顶且 token 消耗减半,低成本模式性能匹敌 Opus。

2026-09-01 ~ 2026-09-02 · 4 集 · 70 条

第 1 集 · Claude Fable 5.1 疑似现身 Bedrock 与官方文档,发布在即(2026-09-01,5 条)

多个独立线索显示 Anthropic 的 Claude Fable 5.1 已进入发布前的最后准备阶段,官方尚未正式公告,但版本上线或指日可待。

已确认

  • Amazon Bedrock API 中已出现 Fable 5.1 的模型 slug:查询该 ID 返回 404 "Model not found",而查询无效 slug(如 Opus 5.1 或乱码)返回 400,这种差异通常出现在模型正式发布前的预注册阶段(@koltregaskes、@haider1 转述)。
  • Anthropic 的 Claude 官方支持文档中已开始出现对 Fable 5.1 的提及,被视作发布临近的信号(@kimmonismus)。

尚未确认

  • 具体发布时间:有爆料称"预计明天发布"(@danielmac8 转述),但无官方公告佐证,仅属传闻。
  • 功能细节:有消息称新版本将优化长时 Agent 任务与代码能力,并改进多 Agent 编排;开发人员 ClaudeDevs 提到正在开发让用户从 Claude 获得更多价值的变更。这些均为转述性说法,官方未证实。

为什么重要

  • Fable 5 于 6 月推出,定位为长时 Agent 和大型代码任务,曾在相关评测中有过突出表现。若 5.1 延续该定位并强化 Agent 编排与代码能力,将直接影响依赖 Claude 做 Agent 开发的用户与企业的选型。
  • Bedrock 预注册加官方文档泄露的组合,历来是模型发布前的典型征兆,社区据此普遍预期发布将在近日发生。

第 2 集 · Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1,缓存成本降 75%(2026-09-02,56 条)

9 月 2 日,Anthropic 正式发布 Claude Fable 5.1 与 Claude Mythos 5.1。Fable 5.1 是当前能力最强的模型升级版,专精复杂长时任务与科学研究;Mythos 5.1 与其同底层,但仅限受信任访问计划,面向网络防御与生命科学场景。新模型基准显著提升、缓存成本大降,并随 Claude Code 2.1.257 默认上线,发布同时重置了所有用户的使用限额。

已确认

  • 性能:Terminal-Bench-Science 0.1 得分 52.6%(Fable 5 为 24.7%),翻倍有余;Terminal-Bench 4.0 整体登顶;@kimmonismus 转述称在 Terminal-Bench 4.0、Science-Bench 与 HLE 等基准上均有巨大飞跃,@markk 还补充了 CursorBench 的提升。@Anxious-Yoghurt-9207 转述 Fable 5.1 在 Artificial Analysis 评测中以 66 分排名第一。在较低努力层级下即可超过 Fable 5 的效果。
  • 定价:输入/输出维持 $10/$50 每百万 Token;Prompt Cache 读取成本从 $1 降至 $0.25,降幅 75%。官方与 @kimmonismus、@markk 转述均确认典型工作负载成本约降 25%,重度缓存场景成本降幅约 45%(@drcintas 转述为 25%45%)。
  • 可用性:已上线 Claude API 与应用;Claude Code v2.1.257 将其设为默认模型,支持 100 万上下文,并加强自动模式安全。@avilacjf 报告 Anthropic 同时在 YouTube 发布了官方介绍视频。
  • 配套政策:发布同时重置所有用户的 5 小时与周使用限额(@thesaraharminta 转述)。
  • 隐私与安全:引入企业级零留存防护等隐私安全升级(@claudeai)。Fable 5.1 与 Mythos 5.1 为同一模型的不同安全等级版本。

时间线

  • 发布当日早些时候,@External-Grape-2978 等 Reddit 用户发现应用中悄然出现该模型,位于 Opus 5 之上,当时无官方公告与模型卡,Bedrock 标识符一度显示未找到;随后 Anthropic 官方正式宣布发布。

为什么重要

  • 缓存降价 75% 对 Coding Agents 等长上下文重复利用场景影响最大,@markk 称这是最被低估的改进,可显著降低编程成本。
  • 同一模型分「通用/受信」两档发布,体现了 Anthropic 对高危行业(网络防御、生命科学)采取差异化安全管控的产品策略。
  • @kimmonismus 认为这是一次强力发布,将迫使 OpenAI 与 Astra 做出回应。

还有 36 条相关讨论 →

第 3 集 · Every 实测 Fable 5.1:编码登顶且 token 减半(2026-09-02,7 条)

Every.to 团队(Dan Shipper 等)在 Vibe Check 栏目对 Anthropic 新发布的 Fable 5.1 进行了深度上手评测,核心结论是「Anthropic 回来了」:Fable 5.1 是目前最强的编码模型之一,且价格大幅下降。评测背景是 Anthropic 前两次发布 Sonnet 5 和 Opus 5 反响平平,市场对后续模型颇为观望。

已确认

  • Fable 5.1 比 Fable 5 更强大,能解决后者无法解决的编码挑战,并可持续运行数天处理大型编码任务
  • 与 Opus 5 相比,Fable 5.1 在编程能力上完胜,被认为接棒最佳编码模型的地位(初代 Fable 曾被评测方称为「曲速引擎」级的最强编程模型)
  • 成本显著下降:实测完成相似任务的 token 消耗约为 Opus 5 的一半
  • 速度更快、交互更友好,语言输出更易理解,摆脱了原版 Fable 和 Sonnet 5/Opus 5 的古怪晦涩风格,对话体验更自然

为什么重要

  • 在连续两次发布失利后,Fable 5.1 直接关系到 Anthropic 在编码模型竞争中的位置,评测认为其重新确立了领先优势
  • 能力提升与 token 消耗减半叠加,意味着开发者在长时大型任务上的性价比显著改善,可能影响团队选型

评测方为 Every.to 团队(作者 Dan Shipper 等),结论基于其实测,非官方基准数据。

第 4 集 · Claude Fable 5.1 低成本模式实测:性能匹敌 Opus 花费更少(2026-09-02,2 条)

Anthropic 工程师与实测报告均指出 Claude Fable 5.1 的性价比优化技巧:在 CursorBench 上,低努力模式与高努力模式表现打平,但成本大幅降低;低配置下性能即可匹敌 Opus。评测建议用户在按任务计费场景下优先尝试“低努力”模式,并结合缓存优化进一步压缩开支。